SSD Nodes Learn 🎉 VPS desde $4.99/mes
Guías Matt ConnorPor Matt Connor

Claude Fable 5: precio y cuándo usarlo

Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 de salida. Consulta qué significan las tarifas publicadas para tus trabajos reales.

¿Cuánto cuesta Claude Fable 5?

Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida en la API de Claude. Estas son las tarifas de lista publicadas por Anthropic, consultadas en la página de precios el 3 de agosto de 2026. El ID de modelo de la API es claude-fable-5. Estuvo disponible de forma general desde el 9 de junio de 2026 en la API de Claude, Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Considérelo como una escala. Fable 5 aparece con un precio doble que Claude Opus 5, cinco veces superior a la tarifa actual de Claude Sonnet 5 y diez veces superior a Claude Haiku 4.5. La proporción es la misma en ambos componentes de la factura, porque todos los modelos de esa tabla facturan la salida exactamente a cinco veces su propia tarifa de entrada. Por tanto, si conoce la distribución de tokens de entrada y salida de un trabajo, puede convertir un precio en cualquier otro mediante una multiplicación.

Una fecha cambia el cálculo. Sonnet 5 tiene un precio introductorio de $2 y $10 por millón de tokens hasta el 31 de agosto de 2026. Desde el 1 de septiembre de 2026, sus tarifas serán $3 y $15. El precio de Fable 5 no cambia, por lo que la diferencia entre ambos se reduce de cinco veces a algo más de tres veces ese día. Si está preparando un presupuesto para el otoño, use las tarifas posteriores de Sonnet.

Los descuentos y el único multiplicador que aumenta el coste

El almacenamiento en caché del prompt es el factor con mayor impacto. Leer de la caché cuesta una décima parte del precio base de entrada: $1 por millón de tokens en Fable 5. Escribir en la caché cuesta más que un token de entrada normal: 1.25 veces el precio base para la caché de cinco minutos y 2 veces el precio base para la caché de una hora. La caché de cinco minutos se amortiza después de una sola lectura y la de una hora, después de dos lecturas. Este cálculo justifica calcular cuándo el almacenamiento en caché del prompt alcanza el punto de equilibrio antes de activarlo en todas partes.

La Batch API aplica un descuento del 50% a ambos componentes, por lo que el trabajo por lotes con Fable 5 cuesta $5 y $25 por millón de tokens. Las solicitudes por lotes son asíncronas, por lo que esta opción sólo resulta útil para trabajos que no necesitan una respuesta inmediata. Los dos descuentos se acumulan, lo que hace que un trabajo almacenado en caché y procesado por lotes sea barato tanto en la entrada como en la salida.

La ventana de contexto de 1M de tokens está incluida con las tarifas estándar en Claude 4.6 y los modelos posteriores. No existe un recargo por contexto largo, por lo que una solicitud de 900k tokens se factura con la misma tarifa por token que una de 9k tokens.

El multiplicador que aumenta la factura corresponde a la residencia de los datos. Si se configura inference_geo: "us" para mantener la inferencia dentro de Estados Unidos, se aplica un multiplicador de 1.1 a cada categoría de tokens, incluidas las lecturas y escrituras de la caché. Mantenga el enrutamiento global predeterminado salvo que un contrato exija otra configuración.

Una regla de facturación es específica de este modelo. Fable 5 incluye clasificadores de seguridad que pueden rechazar una solicitud. Cuando ocurre, la Messages API devuelve stop_reason: "refusal" con una respuesta HTTP 200 correcta en lugar de un error, y no se factura la solicitud rechazada antes de generar ninguna salida. Si reintenta el mismo prompt con otro modelo de Claude, el crédito de fallback reembolsa el coste de la caché del prompt asociado al cambio, por lo que no paga dos veces para precalentar la misma caché.

¿Qué planes incluyen Claude Fable 5?

A fecha de 3 de agosto de 2026, la página de Claude Fable de Anthropic indica que el modelo está disponible para usuarios Pro, Max, Team y Enterprise. El plan gratuito no aparece mencionado. Para desarrolladores, está disponible de forma general en Claude API y a través de los marketplaces en la nube indicados anteriormente.

Que esté disponible en un plan no significa que esté incluido sin límites. La tabla comparativa de planes de la página de precios de Anthropic limita Fable a una parte de los límites de uso semanales en algunas cuentas y a créditos de uso en otras. Esta configuración cambió más de una vez durante julio de 2026. La propia declaración de Anthropic sobre el redespliegue de Fable 5 incluía el modelo hasta el 50% de los límites de uso semanales hasta el 7 de julio de 2026 en los planes Pro, Max, Team y determinados planes Enterprise, con créditos de uso después de esa fecha. Las publicaciones del resto de julio describieron nuevas ampliaciones y una separación entre tipos de cuenta.

Por eso, esta página no indica un límite por plan. Ninguna cifra publicada durante ese mes se mantuvo vigente durante dos semanas, y mostrar aquí un número obsoleto sería peor que no mostrar ninguno. Abra la fila denominada Fable en la tabla comparativa de planes el día que vaya a decidir y considere obsoleta cualquier cifra de un artículo de noticias.

Lo que sí se mantiene estable es la tarifa de la API. En cualquier modalidad, una vez agotada la asignación incluida, el uso adicional de Fable 5 se factura según los precios del cuadro anterior. Por tanto, la lista de precios es la cifra que debe usar para planificar en ambos casos. Es la misma conclusión que se obtiene al comparar la facturación de la API con una suscripción para cualquier otro modelo de Claude. Si todavía no ha elegido un nivel, empiece por qué plan de Claude se adapta a su uso.

Por qué el coste supera lo que sugiere la relación de precios

Hay dos mecanismos documentados que hacen que Fable 5 cueste más de lo que indica una comparación directa de precios.

El primero es el tokenizador. Fable 5 usa el tokenizador introducido con Claude Opus 4.7. En comparación con los modelos publicados antes de Opus 4.7, el mismo texto produce aproximadamente un 30% más de tokens, y el aumento exacto depende del contenido. Haiku 4.5 es anterior a ese tokenizador, por lo que la diferencia de diez veces de la lista de precios se acerca a trece veces cuando se proporciona a ambos modelos el mismo bloque de texto. Sonnet 5 usa el tokenizador más reciente, por lo que la comparación por token entre Fable y Sonnet es válida. La comparación entre Fable y Haiku no lo es.

El segundo mecanismo es el razonamiento. El razonamiento adaptativo está siempre activado en Fable 5, y thinking: {"type": "disabled"} no es compatible. Los tokens de razonamiento se facturan como tokens de salida, con la tarifa completa de salida. La cadena de razonamiento sin filtrar nunca se devuelve en este modelo, y thinking.display tiene el valor predeterminado "omitted", lo que significa que una respuesta visible breve puede incluir un recuento elevado de tokens de salida facturados. La documentación de Anthropic lo indica claramente: el número de tokens de salida facturados no coincide con el número de tokens visibles de la respuesta.

Consulte el desglose en lugar de hacer suposiciones. El campo usage.output_tokens_details.thinking_tokens indica cuántos tokens de salida facturados se destinaron al razonamiento:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

En ese ejemplo, tomado de la documentación de Anthropic sobre el razonamiento, 312 de los 348 tokens de salida facturados correspondían a razonamiento que nadie llegó a ver. Cuando usa streaming, este desglose sólo llega en el evento message_delta final, por lo que un cliente que deja de leer después del último fragmento de texto nunca lo registra.

El control es effort, configurado en output_config.effort, con los niveles low, medium, high (el valor predeterminado), xhigh y max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

La recomendación de Anthropic para este modelo es empezar con high, subir a xhigh sólo para los trabajos más sensibles a la capacidad y bajar a medium o low para las tareas rutinarias, porque un nivel de esfuerzo menor en Fable 5 suele superar a xhigh en los modelos anteriores. Esto introduce dos problemas. Cambiar el nivel de esfuerzo entre solicitudes invalida la caché de prompts, porque el valor de esfuerzo resuelto se incorpora al prompt. Por tanto, elija un nivel por carga de trabajo y manténgalo constante. Además, max_tokens es un límite estricto para la salida total, que combina el razonamiento y el texto de respuesta, por lo que un límite calculado para una respuesta sin razonamiento provocará un truncamiento. Si aparece stop_reason: "max_tokens", debe aumentar el límite o reducir el nivel de esfuerzo.

Coste por tarea completada, no coste por token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Esas 3 filas son cálculos aritméticos, no una comparativa de rendimiento. Las tarifas están publicadas. Los volúmenes de tokens son supuestos que debe sustituir por cifras de sus propios datos de uso. Una sesión de programación con una carga similar a la fila intermedia cuesta $5.00 con Fable 5, frente a $1.00 con Sonnet 5. La ejecución larga cuesta $40.00 frente a $8.00. La columna de Haiku de esa última fila es sólo aritmética: Haiku 4.5 tiene una ventana de contexto de 200k tokens, por lo que no puede contener ese trabajo.

El coste por token es la unidad equivocada para tomar una decisión. El coste por tarea completada es el coste por intento multiplicado por el número de intentos. Con las tarifas actuales, un intento con Fable 5 cuesta lo mismo que cinco intentos con Sonnet 5, por lo que el número de reintentos por sí solo casi nunca justifica la actualización. Sonnet tendría que fallar más de cuatro veces de cada cinco para que la opción barata dejara de ser más económica en tokens.

Lo que sí lo justifica es todo lo que la factura de tokens no incluye. La diferencia entre las dos ejecuciones largas del gráfico es inferior al coste de una hora de trabajo de un ingeniero en la mayoría de los mercados. Si el modelo más caro ahorra una hora de revisión o evita una migración incorrecta que después tendría que deshacer, ya se ha amortizado con un ahorro que la factura nunca muestra. Haga la comparación en dinero por resultado aceptado e incluya su propio tiempo en el total. Saber cuánto se obtiene realmente por un millón de tokens permite hacer esa estimación de forma mucho menos abstracta.

Tres trabajos en los que Claude Fable 5 justifica su precio

Ejecuciones de agentes con un horizonte largo, en las que un desvío resulta costoso. Fable 5 está diseñado para trabajos que se miden en horas: una ventana de contexto de 1M de tokens, hasta 128k tokens de salida por solicitud y un nivel de esfuerzo xhigh orientado a tareas que duran más de treinta minutos y utilizan presupuestos de millones de tokens. Compare el coste de la ejecución con el trabajo de limpieza posterior si el agente toma una rama incorrecta en el paso 40 y nadie lo detecta hasta el paso 300.

Una migración o una auditoría que se ejecuta una sola vez en una base de código grande. En los trabajos puntuales no hay volumen que permita amortizar el coste, por lo que la prima por token se carga en una sola factura y todo el trabajo puede caber en una única ventana de contexto. Si puede ejecutarse de forma asíncrona, la Batch API reduce el coste a la mitad: $25 por millón de tokens de salida.

La tarea en la que un modelo más económico ya ha fallado dos veces. Dos intentos fallidos, más el tiempo dedicado a depurarlos, cuestan más que un intento con Fable en los volúmenes del gráfico anterior. Escalar al siguiente nivel es la opción más económica, y para eso sirve una jerarquía de modelos. Si todavía está eligiendo entre niveles en términos generales, la comparación de capacidades entre los niveles de modelos Claude responde a una pregunta distinta de la que plantea esta página.

Tres trabajos en los que Sonnet 5 o Haiku 4.5 son la respuesta adecuada

Clasificación y extracción de gran volumen. Estos trabajos se evalúan por rendimiento y coste unitario, y el límite de calidad es lo bastante bajo como para que un modelo económico lo alcance. Si una tarea que Haiku 4.5 completa correctamente cuesta diez veces más, Fable 5 no aporta ninguna mejora medible.

Trabajo interactivo en el que la latencia es el producto. La tabla de modelos de Anthropic indica que la latencia comparativa de Fable 5 es mayor, y el razonamiento no se puede desactivar. Un cuadro de chat o una finalización en un editor se percibe peor con el modelo más capaz, porque los usuarios notan la espera antes que la calidad.

Cualquier tarea que dependa de eventos posteriores a enero de 2026. El límite de conocimiento fiable de Fable 5 es enero de 2026. El de Opus 5 es mayo de 2026. El modelo más caro está menos actualizado, por lo que en las consultas sobre actualidad se paga el doble por conocimientos más antiguos, salvo que se le proporcionen herramientas de búsqueda o recuperación.

Hay una limitación que no depende del coste. Fable 5 conserva los datos durante 30 días y no está disponible con retención cero porque está designado como Covered Model. Si su acuerdo exige retención cero, Fable 5 no es una opción a ningún precio y ningún descuento cambia esa condición.

Lo que muestran los repositorios del método fable y lo que no muestran

Los profesionales han publicado repositorios que condensan cómo abordar las tareas al estilo de Fable 5 en habilidades que un modelo más barato puede seguir. El repositorio fable-method describe una habilidad de razonamiento, un ciclo de orquestación y un verificador adversarial que vuelve a ejecutar cada comprobación declarada, en lugar de limitarse a leer el informe del agente. Su README lo indica directamente: "Esta es una síntesis de la comunidad, no un artefacto de Anthropic."

Trátelo exactamente como tal. Es una evidencia de cómo las personas dirigen el modelo, no documentación sobre cómo funciona el modelo. Anthropic no ha validado nada de su contenido. Además, existen varias bifurcaciones casi idénticas con redacciones distintas. Eso es lo esperable de una tradición informal, no de una especificación.

La señal útil para decidir sobre costes es que los elementos que la gente consideró útiles para copiar son procedimentales. Clasifique la tarea, indique la comprobación que demuestra que está terminada, recopile pruebas antes de decidir y verifique mediante la observación, no mediante la lectura de un resumen. Si entrega a un modelo más barato una lista de comprobación explícita y un paso de verificación, puede reducir parte de la diferencia. Por eso, ejecute ese experimento con su propio conjunto de evaluación antes de estandarizar el uso del modelo más caro. El resultado depende de sus tareas. Por ese motivo, la cifra de otra persona le sirve de poco.

Compruebe sus propios números antes de comprometer presupuesto

  • Lea usage en cada respuesta y registre output_tokens_details.thinking_tokens por separado de la salida visible. El razonamiento que no ve es la partida que puede generar sorpresas.
  • Establezca effort explícitamente en lugar de aceptar el valor predeterminado y manténgalo constante durante cualquier conversación que dependa de la caché de prompts.
  • Coloque primero su prefijo estable detrás de un punto de interrupción de caché. Una lectura de caché a una décima parte del precio de entrada base ahorra más que la mayoría de las reducciones de modelo.
  • Traslade a la Batch API todo lo que no necesite una respuesta inmediata.
  • Calcule honestamente el precio de la alternativa. Comparar los precios de las API de Claude y ChatGPT según su propia carga de trabajo merece una tarde antes de asumir un compromiso prolongado.

Si la carga de trabajo corresponde a un agente que se ejecuta en su propio servidor, los controles más importantes están fuera de la elección del modelo. Mantener bajo control los costes de un agente en un VPS explica los límites del bucle y los topes de gasto que detienen una sesión descontrolada, y dónde Claude Code consume realmente tokens explica los números que verá en el panel de uso.

FAQ

¿Cuánto cuesta Claude Fable 5 por millón de tokens?

Claude Fable 5 tiene un precio de $10 por millón de tokens de entrada y $50 por millón de tokens de salida en la API de Claude, según la página de precios de Anthropic consultada el 3 de agosto de 2026. La lectura de caché cuesta $1 por millón de tokens, una décima parte de la tarifa base de entrada. La Batch API aplica un descuento del 50% a ambos conceptos, con precios de $5 y $25 por millón de tokens para trabajos asíncronos. Mantener la inferencia dentro de Estados Unidos mediante el parámetro inference_geo añade un multiplicador de 1.1 a todas las categorías.

¿Claude Fable 5 está incluido en una suscripción Claude Pro?

La página de Claude Fable de Anthropic indica que el modelo está disponible para usuarios Pro, Max, Team y Enterprise, pero no menciona el plan gratuito. El acceso incluido no es ilimitado. Algunas cuentas acceden a Fable como parte de los límites de uso semanales y otras mediante créditos de uso. Este sistema cambió más de una vez durante julio de 2026. Consulte la fila Fable de la tabla comparativa de planes en la página de precios de Anthropic el día que vaya a decidir, en lugar de confiar en una cifra publicada en un artículo. Cuando se agota la cuota incluida, el uso adicional se factura según la tarifa de la API.

¿Por qué mi factura de Claude Fable 5 es superior a lo que parece indicar la salida visible?

El razonamiento adaptativo siempre está activado en Claude Fable 5. Los tokens de razonamiento se facturan como tokens de salida y la cadena de pensamiento sin procesar nunca se devuelve. Con thinking.display en su valor predeterminado de omitted, verá un campo de razonamiento vacío, aunque se facture cada token de razonamiento generado internamente. Consulte usage.output_tokens_details.thinking_tokens en la respuesta para ver el desglose. Tenga en cuenta que, al usar streaming, sólo llega en el evento message_delta final. Reduzca el nivel effort si la proporción entre razonamiento y respuesta es superior a lo que necesita la tarea.

¿Debo usar Claude Fable 5 o Claude Opus 5?

Claude Opus 5 cuesta la mitad por token y tiene una fecha de corte de conocimientos fiable más reciente: mayo de 2026, frente a enero de 2026 en Fable 5. Empiece con Opus 5 y cambie a Fable cuando una tarea falle con Opus 5 o cuando el coste de una respuesta incorrecta supere la diferencia de precio. Fable 5 es la opción adecuada para trabajos de agentes con horizontes largos, en los que una rama incorrecta puede requerir horas de limpieza, y para trabajos puntuales cuyo sobrecoste se concentra en una sola factura en lugar de aplicarse a todas las solicitudes de forma permanente.

#claude#fable#model-selection#pricing#tokens