SSD Nodes Learn Hosting plans →
Guías Matt ConnorPor Matt Connor · Actualizado 2026-09-06

Claude Fable 5: precio y cuándo usarlo

Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 de salida. Consulta qué significan las tarifas publicadas para tus trabajos reales.

¿Cuánto cuesta Claude Fable 5?

Claude Fable 5 cuesta $10 por cada millón de tokens de entrada y $50 por cada millón de tokens de salida en Claude API. Esas son las tarifas públicas de Anthropic, obtenidas de la página de precios el 3 de agosto de 2026. El ID del modelo en la API es claude-fable-5. Estuvo disponible para el público general desde el 9 de junio de 2026 en Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Interprételo como una escala. Fable 5 tiene un precio el doble que Claude Opus 5, cinco veces superior a la tarifa actual de Claude Sonnet 5 y diez veces superior a Claude Haiku 4.5. La proporción es la misma para la entrada y la salida, porque todos los modelos de esa tabla cobran la salida exactamente a cinco veces su propia tarifa de entrada. Por tanto, si conoce la distribución de tokens de entrada y salida de un trabajo, puede convertir un precio en cualquier otro mediante una multiplicación.

Una fecha cambia el cálculo. Sonnet 5 tiene una tarifa promocional de $2 y $10 por cada millón de tokens hasta el 31 de agosto de 2026. Desde el 1 de septiembre de 2026, sus tarifas serán $3 y $15. El precio de Fable 5 no cambia, por lo que la diferencia entre ambos se reduce de cinco veces a algo más de tres veces ese día. Si prepara un presupuesto para el otoño, use las tarifas posteriores de Sonnet.

Los descuentos y el único multiplicador que aumenta el coste

El almacenamiento en caché de prompts es la palanca más importante. Leer de la caché cuesta una décima parte del precio base de entrada: $1 por millón de tokens en Fable 5. Escribir en la caché cuesta más que un token de entrada normal: 1.25 veces el precio base para la caché de cinco minutos y 2 veces el precio base para la caché de una hora. La caché de cinco minutos se amortiza después de una sola lectura, y la de una hora, después de dos lecturas. Este cálculo explica por qué conviene calcular cuándo se amortiza el almacenamiento en caché de prompts antes de activarlo en todas partes.

Batch API aplica un descuento del 50% a ambos lados, por lo que el trabajo por lotes en Fable 5 cuesta $5 y $25 por millón de tokens. Las solicitudes por lotes son asíncronas, así que esto sólo beneficia al trabajo que no necesita una respuesta inmediata. Los dos descuentos se acumulan, lo que hace que un trabajo almacenado en caché y procesado por lotes sea barato en ambas categorías.

La ventana de contexto de 1M de tokens está incluida con las tarifas estándar en Claude 4.6 y los modelos posteriores. No hay recargo por contexto largo, por lo que una solicitud de 900k tokens se factura con la misma tarifa por token que una de 9k.

El multiplicador que aumenta la factura corresponde a la residencia de datos. Configurar inference_geo: "us" para mantener la inferencia dentro de Estados Unidos aplica un multiplicador de 1.1 a todas las categorías de tokens, incluidas las lecturas y escrituras de la caché. Mantenga el enrutamiento global predeterminado, salvo que un contrato exija otra configuración.

Hay una regla de facturación específica de este modelo. Fable 5 incluye clasificadores de seguridad que pueden rechazar una solicitud. Cuando ocurre, Messages API devuelve stop_reason: "refusal" como una respuesta HTTP 200 correcta en lugar de un error, y no se factura una solicitud rechazada antes de generar cualquier salida. Si reintenta el mismo prompt en otro modelo de Claude, el crédito de fallback reembolsa el coste de la caché de prompts del cambio, por lo que no paga dos veces por calentar la misma caché.

¿Qué planes incluyen Claude Fable 5?

A fecha de 3 de agosto de 2026, la página de Claude Fable de Anthropic indica que el modelo está disponible para usuarios Pro, Max, Team y Enterprise. El plan gratuito no aparece mencionado. Pro es el nivel más barato de esa lista, por lo que el precio de Pro y dónde terminan sus límites de uso establece el coste mínimo de cualquier suscripción a Fable. Si el acceso a Fable sería el motivo principal para actualizar el plan, revise primero si merece la pena pagar una cuenta Pro según su uso porque una asignación limitada de Fable no justifica por sí sola la suscripción. Para desarrolladores, está disponible de forma general en Claude API y mediante los marketplaces de nube indicados arriba. Esa vía no tiene un nivel gratuito, por lo que el pequeño crédito que Anthropic concede al registrarse es todo lo que recibirá antes de que empiece a contabilizarse el consumo.

Disponible en un plan no significa que esté incluido sin límite. Tampoco una suscripción se mide como la API, porque una cuenta Pro no tiene ninguna cuota de tokens publicada y contabiliza el uso en mensajes dentro de una ventana móvil. Por tanto, ningún elemento de un plan se convierte directamente en las cifras por millón indicadas arriba. La tabla comparativa de planes de la página de precios de Anthropic condiciona el acceso a Fable a una parte de los límites de uso semanales en algunas cuentas y a créditos de uso en otras. Esta configuración cambió más de una vez durante julio de 2026. La declaración de Anthropic sobre la redistribución de Fable 5 incluía el modelo hasta el 50% de los límites de uso semanales hasta el 7 de julio de 2026 en los planes Pro, Max, Team y algunos planes Enterprise. Después de esa fecha se aplicaban créditos de uso. Los informes publicados durante el resto de julio describieron nuevas ampliaciones y una separación entre tipos de cuenta.

Por eso, esta página no mostrará un límite por plan. Ninguna cifra publicada durante ese mes se mantuvo vigente durante dos semanas, y un número desactualizado sería peor que no mostrar ninguno. Abra la fila denominada Fable en la tabla comparativa de planes el día que tome la decisión y considere desactualizada cualquier cifra de un artículo de noticias. Si contrata una cuenta para acceder a Fable y la asignación resulta ser menor de lo que esperaba según la tabla, bajar de plan antes de la siguiente renovación conserva intacto el mes que ya ha pagado.

Lo que sí se mantiene estable es la tarifa de la API. En cualquier vía, una vez agotada la asignación incluida, el uso adicional de Fable 5 se factura según los precios del gráfico anterior. Enterprise hace explícita esta estructura, porque la cuota de la cuenta Enterprise compra el acceso, mientras que los tokens siguen facturándose según las tarifas de la API aparte. Por tanto, la lista de precios es la cifra que debe usar para planificar en ambos casos. Es la misma conclusión que se obtiene al comparar la facturación de la API con una suscripción para cualquier otro modelo de Claude. Si todavía no ha elegido un nivel, empiece por qué plan de Claude se adapta a su uso. Si esa cuenta también será su asistente diario y no sólo una forma de acceder a Fable, conviene comprobar cómo se comparan los precios de los planes de Claude con los de ChatGPT antes de decidirse.

Por qué la factura supera lo que sugiere la proporción de precios

Hay dos mecanismos documentados que hacen que Fable 5 cueste más de lo que indica una comparación directa de precios.

El primero es el tokenizador. Fable 5 usa el tokenizador introducido con Claude Opus 4.7. En comparación con los modelos publicados antes de Opus 4.7, el mismo texto genera aproximadamente un 30% más de tokens, y el aumento exacto depende del contenido. Haiku 4.5 es anterior a ese tokenizador, por lo que la diferencia de diez veces de la lista de precios se acerca a trece veces cuando se proporciona a ambos modelos el mismo bloque de texto. Sonnet 5 usa el tokenizador más reciente, por lo que la comparación entre Fable y Sonnet por token es válida. La comparación entre Fable y Haiku no lo es.

El segundo es el razonamiento. El razonamiento adaptativo está siempre activado en Fable 5 y thinking: {"type": "disabled"} no es compatible. Los tokens de razonamiento se facturan como tokens de salida, con la tarifa completa de salida. La cadena de razonamiento sin procesar nunca se devuelve en este modelo y thinking.display toma "omitted" de forma predeterminada, lo que significa que una respuesta visible breve puede incluir una gran cantidad de salida facturada. La documentación de Anthropic lo indica claramente: la cantidad de tokens de salida facturados no coincide con la cantidad de tokens visibles de la respuesta.

Consulte el desglose en lugar de hacer suposiciones. El campo usage.output_tokens_details.thinking_tokens indica cuántos tokens de salida facturados se destinaron al razonamiento:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

En ese ejemplo, tomado de la documentación de Anthropic sobre el razonamiento, 312 de los 348 tokens de salida facturados correspondían a razonamiento que nadie llegó a ver. Al transmitir la respuesta, este desglose sólo llega en el evento message_delta final, por lo que un cliente que deja de leer después del último fragmento de texto nunca lo registrará.

El control es effort, establecido en output_config.effort, con los niveles low, medium, high (el valor predeterminado), xhigh y max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

La recomendación de Anthropic para este modelo es comenzar con high, subir a xhigh sólo para las tareas más sensibles a la capacidad y bajar a medium o low para el trabajo rutinario, porque un esfuerzo menor en Fable 5 suele superar a xhigh en los modelos anteriores. Esto incluye dos problemas. Cambiar el nivel de esfuerzo entre solicitudes invalida la caché de solicitudes, porque el valor de esfuerzo resuelto se incorpora a la solicitud. Por tanto, elija un nivel por carga de trabajo y manténgalo constante. Además, max_tokens es un límite estricto para la salida total, que combina el razonamiento y el texto de respuesta, por lo que un límite calculado para una respuesta sin razonamiento provocará un truncamiento. Si aparece stop_reason: "max_tokens", debe aumentar el límite o reducir el esfuerzo.

Coste por tarea completada, no coste por token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Esas 3 filas son cálculos aritméticos, no un benchmark. Las tarifas son públicas. Los volúmenes de tokens son supuestos que debe sustituir por cifras de sus propios datos de uso. Una sesión de programación con un perfil similar al de la fila central cuesta $5.00 con Fable 5, frente a $1.00 con Sonnet 5. La ejecución larga cuesta $40.00, frente a $8.00. La columna de Haiku en esa última fila es sólo un cálculo aritmético: Haiku 4.5 tiene una ventana de contexto de 200k tokens, por lo que no puede contener ese trabajo.

El coste por token es la unidad equivocada para tomar una decisión. El coste por tarea completada es el coste por intento multiplicado por el número de intentos. Con las tarifas actuales, un intento con Fable 5 cuesta lo mismo que cinco intentos con Sonnet 5, por lo que el número de reintentos por sí solo casi nunca justifica la actualización. Sonnet tendría que fallar más de cuatro veces de cada cinco para que la opción barata dejara de ser rentable por consumo de tokens.

Lo que sí lo justifica es todo lo que la factura de tokens no incluye. La diferencia entre las dos ejecuciones largas del gráfico es inferior al coste de una hora de trabajo de un ingeniero en la mayoría de los mercados. Si el modelo más caro ahorra una hora de revisión o evita una migración incorrecta que después debe deshacer, ya se ha amortizado, aunque la factura no muestre ese ahorro. Compare el coste por resultado aceptado e incluya su propio tiempo en el total. Saber qué se obtiene realmente con un millón de tokens hace que esa estimación sea mucho menos abstracta.

Tres trabajos en los que Claude Fable 5 justifica su precio

Ejecuciones de agentes de larga duración en las que un desvío resulta costoso. Fable 5 está diseñado para trabajos que se miden en horas: una ventana de contexto de 1M tokens, hasta 128k tokens de salida por solicitud y un nivel de esfuerzo xhigh orientado a tareas de más de treinta minutos, con presupuestos de tokens de varios millones. Compare el coste de la ejecución con el trabajo de limpieza necesario después de que un agente tome una rama incorrecta en el paso 40 y nadie lo detecte hasta el paso 300.

Una migración o una auditoría que se ejecuta una sola vez en una base de código grande. El trabajo puntual no permite amortizar el volumen, por lo que la prima por token se carga en una sola factura y es posible que todo el trabajo quepa en una única ventana de contexto. Si puede ejecutarse de forma asíncrona, la Batch API reduce el coste a la mitad: $25 por millón de tokens de salida.

La tarea en la que un modelo más barato ya ha fallado dos veces. Dos intentos fallidos, más el tiempo de depuración, cuestan más que un intento con Fable en los volúmenes del gráfico anterior. Escalar al siguiente nivel es la opción más barata, y para eso sirve una jerarquía de modelos. Si todavía está eligiendo entre niveles en general, la comparación de capacidades entre los niveles de modelos de Claude responde a una pregunta distinta de la que aborda esta página.

Tres trabajos en los que Sonnet 5 o Haiku 4.5 son la respuesta adecuada

Clasificación y extracción de gran volumen. Estos trabajos se evalúan por el rendimiento y el coste por unidad, y el límite de calidad es lo bastante bajo para que un modelo económico lo alcance. Si una tarea que Haiku 4.5 completa correctamente cuesta diez veces más, Fable 5 no aporta nada que se pueda medir.

Trabajo interactivo en el que la latencia es el producto. La tabla de modelos de Anthropic indica que la latencia comparativa de Fable 5 es mayor, y el razonamiento no se puede desactivar. Un cuadro de chat o una sugerencia de código en un editor ofrece una experiencia peor con el modelo más capaz, porque los usuarios perciben la espera antes que la calidad.

Cualquier tarea que dependa de eventos posteriores a January 2026. El límite de conocimiento fiable de Fable 5 es January 2026. El de Opus 5 es May 2026. El modelo más caro está menos actualizado, por lo que, en preguntas sobre actualidad, se paga el doble por conocimientos más antiguos, salvo que se le proporcionen herramientas de búsqueda o recuperación.

Hay una limitación que no depende del coste. Fable 5 conserva los datos durante 30 días y no está disponible con retención cero de datos, porque está designado como Covered Model. Si su acuerdo exige retención cero, Fable 5 no es una opción a ningún precio y ningún descuento cambia esa condición.

Qué muestran los repositorios del método fable y qué no muestran

Varios profesionales han publicado repositorios que condensan cómo aplicar los enfoques de Fable 5 en habilidades que un modelo más barato puede seguir. El repositorio fable-method describe una habilidad de razonamiento, un bucle de orquestación y un verificador adversarial que vuelve a ejecutar cada comprobación declarada en lugar de limitarse a leer el informe del agente. Su README lo indica directamente: "Esta es una condensación comunitaria, no un artefacto de Anthropic."

Trátelo exactamente como eso. Es una evidencia de cómo las personas están dirigiendo el modelo, no documentación sobre cómo funciona el modelo. Anthropic no ha validado nada de lo que contiene, y existen varios forks casi idénticos con una redacción diferente. Eso es lo esperable de una tradición informal, no de una especificación.

La señal útil para decidir sobre los costes es que las partes que la gente consideró útiles para copiar son procedimentales. Clasifique la tarea, indique la comprobación que demuestra que está terminada, recopile evidencias antes de decidir y verifique mediante observación en lugar de leer un resumen. Si entrega a un modelo más barato una lista de comprobación explícita y un paso de verificación, puede reducir parte de la diferencia. Ejecute ese experimento con su propio conjunto de evaluación antes de estandarizar el uso del modelo caro. El resultado depende de sus tareas, por lo que la cifra de otra persona apenas le sirve.

Comprueba tus propios números antes de comprometer presupuesto

  • Lee usage en cada respuesta y registra output_tokens_details.thinking_tokens por separado de la salida visible. El razonamiento que nunca ves es la partida que sorprende a los usuarios.
  • Establece effort explícitamente en lugar de aceptar el valor predeterminado y mantenlo constante en cualquier conversación que dependa del almacenamiento en caché de prompts.
  • Coloca primero tu prefijo estable detrás de un punto de interrupción de caché. Una lectura de caché a una décima parte del precio de entrada base ahorra más que la mayoría de los cambios a modelos de menor nivel.
  • Mueve a Batch API todo lo que no necesite una respuesta inmediata.
  • Calcula el precio de la alternativa de forma realista. Comparar los precios de las API de Claude y ChatGPT con tu propia carga de trabajo merece una tarde antes de asumir un compromiso prolongado.

Si la carga de trabajo es un agente que se ejecuta en tu propio servidor, los controles más importantes están fuera de la elección del modelo. Mantener bajo control el coste de un agente en un VPS explica los límites del bucle y los topes de gasto que detienen una sesión descontrolada, y dónde consume tokens realmente Claude Code explica los números que verás en el panel de uso.

FAQ

¿Cuánto cuesta Claude Fable 5 por millón de tokens?

Claude Fable 5 tiene un precio de $10 por millón de tokens de entrada y de $50 por millón de tokens de salida en la API de Claude, según la página de precios de Anthropic consultada el 3 de agosto de 2026. La lectura de caché cuesta $1 por millón de tokens, una décima parte de la tarifa base de entrada. La Batch API aplica un descuento del 50 % en ambas categorías, con precios de $5 y $25 por millón de tokens para trabajos asíncronos. Mantener la inferencia dentro de Estados Unidos mediante el parámetro inference_geo añade un multiplicador de 1.1 a todas las categorías.

¿Claude Fable 5 está incluido en una suscripción Claude Pro?

La página de Claude Fable de Anthropic indica que el modelo está disponible para usuarios Pro, Max, Team y Enterprise, y no menciona el plan gratuito. El acceso incluido no es ilimitado. Algunas cuentas acceden a Fable como parte de los límites de uso semanales y otras mediante créditos de uso. Esta configuración cambió más de una vez durante julio de 2026. Consulte la fila Fable de la tabla comparativa de planes en la página de precios de Anthropic el día que tome la decisión, en lugar de confiar en una cifra publicada en un artículo. Cuando se agota la cuota incluida, el uso adicional se factura con la tarifa de la API.

¿Por qué mi factura de Claude Fable 5 es superior a lo que parece indicar la salida visible?

El razonamiento adaptativo está siempre activado en Claude Fable 5, los tokens de razonamiento se facturan como tokens de salida y la cadena de pensamiento sin procesar nunca se devuelve. Con thinking.display en su valor predeterminado de omitted, verá un campo de razonamiento vacío, aunque se facture cada token de razonamiento generado internamente. Consulte usage.output_tokens_details.thinking_tokens en la respuesta para ver el desglose. Tenga en cuenta que, al transmitir la respuesta, sólo llega en el evento message_delta final. Reduzca el nivel effort si la proporción entre razonamiento y respuesta es superior a la que requiere la tarea.

¿Debo usar Claude Fable 5 o Claude Opus 5?

Claude Opus 5 cuesta la mitad por token y tiene una fecha de corte de conocimientos fiables más reciente: mayo de 2026, frente a enero de 2026 en Fable 5. Empiece con Opus 5 y escale a otro modelo cuando una tarea falle allí o cuando el coste de una respuesta incorrecta supere la diferencia de precio. Fable 5 es la opción adecuada para trabajos de agentes con horizontes largos, en los que una rama incorrecta puede exigir horas de limpieza, y para trabajos puntuales cuyo sobrecoste aparece en una sola factura en lugar de aplicarse a cada solicitud de forma permanente.

#claude#fable#model-selection#pricing#tokens