Claude vs ChatGPT API: ¿cuál es más barata?
Compara Claude y ChatGPT API con la fórmula de tokens, tres trabajos con costes reales y el caso clave: Claude puede costar varias veces más en el nivel básico.
La respuesta breve
La comparación de precios de las API de Claude y ChatGPT no tiene un ganador único, porque ambos proveedores fijan precios diferentes para los tokens de entrada y de salida en cada nivel. En agosto de 2026, los dos niveles superiores de Claude cobran lo mismo por cada token de entrada que sus equivalentes de OpenAI y menos por cada token de salida. Por eso, Claude resulta ligeramente más barato en trabajos con muchas salidas. En el nivel más bajo, Claude cuesta varias veces más por el mismo trabajo. Cualquier respuesta que no indique un nivel y una combinación de tokens es una estimación sin fundamento.
Esta página presenta primero el cálculo, después tres cargas de trabajo con sus combinaciones de tokens y, por último, los multiplicadores que pueden influir en una factura real más que la tarifa anunciada.
La única fórmula que necesitas
Ambas API facturan el texto de la misma forma. Pagas por los tokens que envías y pagas una tarifa más alta por los tokens que el modelo devuelve.
cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate
Un token equivale aproximadamente a 4 caracteres en inglés, cerca de 0.75 palabras. Usa este valor solo para una primera estimación. Para obtener el importe real, usa los recuentos que devuelve cada API en el objeto usage de cada respuesta.
# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate
# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))El script muestra 0.005, que equivale a medio centavo por turno. Multiplícalo por el número de turnos previstos al mes para obtener un presupuesto. Aprende esta fórmula: cada cambio de precio posterior se resolverá editando una sola línea, sin repetir el análisis.
Las tarifas publicadas, agosto de 2026
Estas son las tarifas de lista que ambos proveedores publicaron el 1 de agosto de 2026. Este bloque es el único lugar de la publicación donde se indica un precio. Compruébelo en claude.com/pricing y en la página de precios de OpenAI antes de aprobar un presupuesto.
The data behind this chart
[
{
"label": "Frontier",
"claude_input": 5,
"claude_output": 25,
"openai_input": 5,
"openai_output": 30
},
{
"label": "Workhorse",
"claude_input": 2,
"claude_output": 10,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Workhorse from September",
"claude_input": 3,
"claude_output": 15,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Small",
"claude_input": 1,
"claude_output": 5,
"openai_input": 0.2,
"openai_output": 1.2
}
]Las correspondencias se establecen por posición en cada catálogo, no por popularidad. En la gama Frontier se comparan Claude Opus 5 y gpt-5.6-sol. En la gama Workhorse se comparan Claude Sonnet 5 y gpt-5.6-terra. En la gama Small se comparan Claude Haiku 4.5 y gpt-5.6-luna. Ambos proveedores también ofrecen niveles superiores a los de este bloque, y OpenAI mantiene las generaciones anteriores con sus tarifas originales. Comparar un modelo insignia de un proveedor con un modelo económico del otro produce una cifra sin significado. Así es como la mayoría de las comparaciones publicadas obtiene su titular.
Hay que destacar dos aspectos de ese bloque. Las tarifas de entrada de Sonnet 5, 2 y 10, son provisionales. Anthropic documenta que terminan el 31 de agosto de 2026. Después, Sonnet 5 cobra 3 y 15. Este cambio convierte el nivel Workhorse de una ventaja limitada para Claude en una ventaja clara para OpenAI, y se produce dentro del periodo de vigencia de esta publicación.
El segundo aspecto es un patrón que conviene memorizar: Claude fija el precio de salida exactamente en 5 veces su propia tarifa de entrada en todas las filas anteriores, y OpenAI lo fija en 6 veces. Esa proporción, no la tarifa absoluta, es lo que hace que el ganador cambie según la combinación de tokens.
Por qué una tarifa por millón de tokens no permite comparar proveedores
Una tarifa es el costo en dólares por token. Una factura es el costo en dólares por token multiplicado por el número de tokens. El número de tokens de un texto depende del modelo, no del texto.
Anthropic lo documenta directamente: los modelos Claude 4.7 y posteriores, incluidos Claude Opus 5 y Claude Sonnet 5, usan un tokenizador más reciente que produce aproximadamente un 30% más de tokens para el mismo texto que Claude Sonnet 4.6 y anteriores. La tarifa no cambió. La factura sí.
Por tanto, dos tarifas que parecen idénticas no producen dos facturas idénticas. Cuente los tokens en ambos lados con su propio texto antes de confiar en cualquier comparación, incluida esta.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached contract."}]
}'Una respuesta válida es un objeto JSON pequeño que contiene input_tokens. Un 401 indica que la variable de clave está vacía en su shell. Procese el mismo texto con el tokenizador del otro proveedor, divida un recuento por el otro y multiplique esa proporción por la tarifa publicada antes de comparar. Si la proporción favorece a un proveedor por más de aproximadamente 1.2, ese factor supera todas las diferencias de tarifas de la sección anterior.
Escenario uno: una función de chat
Un asistente de soporte dentro de una aplicación web. 120,000 turnos al mes. Cada turno envía un prompt del sistema, esquemas de herramientas, dos fragmentos recuperados de la base de ayuda y algunos mensajes anteriores, unos 1,400 tokens de entrada, y el modelo responde con unos 220 tokens. Es interactivo, por lo que el descuento por procesamiento por lotes nunca se puede aplicar. Ejecútelo en el nivel workhorse.
The data behind this chart
[
{
"label": "List price",
"claude_usd": "600.00",
"openai_usd": "652.80"
},
{
"label": "Cached prefix",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Small tier, cached",
"claude_usd": "213.60",
"openai_usd": "48.00"
}
]Al precio de lista, Claude factura 600.00, frente a 652.80 de OpenAI. Los componentes de entrada son idénticos porque las tarifas de entrada son idénticas. Toda la diferencia está en la salida, y Claude la reduce por un margen demasiado pequeño para elegir un proveedor basándose en él.
Ahora marque 800 de esos 1,400 tokens de entrada como un prefijo estable: el prompt del sistema y los esquemas de herramientas, que no cambian entre turnos. Ambos proveedores cobran el 10% de su tarifa de entrada base por una coincidencia de caché. La factura de Claude baja a 427.20 y la de OpenAI a 480.00. La caché aporta más ahorro que la elección del proveedor, y ambas plataformas la ofrecen.
Aquí es donde Claude pierde. La mayoría de las respuestas de soporte no necesitan un modelo workhorse. Mueva el mismo tráfico al nivel pequeño y Claude factura 213.60, mientras que OpenAI factura 48.00. Divida una cifra por la otra y Claude cuesta aproximadamente cuatro veces y media más por el mismo trabajo. Claude Haiku 4.5 cobra 1 por millón de tokens de entrada, frente a 0.2 de gpt-5.6-luna, y ningún nivel de caché elimina una diferencia de cinco veces. Si su carga de trabajo puede ejecutarse con un modelo pequeño, OpenAI es más barato y el margen es amplio.
Escenario dos: una canalización de documentos con contexto largo
25,000 contratos al mes. Cada solicitud incluye las mismas instrucciones de 9,000 tokens y el mismo esquema JSON, seguidos de 12,000 tokens de texto contractual. El modelo devuelve unos 700 tokens de campos estructurados. La salida representa menos del 4% de los tokens de este trabajo, y ese único dato determina la comparación.
The data behind this chart
[
{
"label": "Chat feature",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Document pipeline",
"claude_usd": "820.00",
"openai_usd": "855.00"
},
{
"label": "Coding agent",
"claude_usd": "116.10",
"openai_usd": "124.20"
}
]Con el prefijo de 9,000 tokens almacenado en caché en ambos lados, Claude factura 820.00 y OpenAI factura 855.00. Los costes de entrada coinciden hasta el último centavo, porque las tarifas de entrada principales coinciden en agosto de 2026. Toda la diferencia está en la salida, cuyo precio es 5 veces el de la entrada en Claude y 6 veces en OpenAI.
Este trabajo también se puede procesar por lotes. Ambos proveedores aplican un descuento del 50% a la entrada y la salida para el trabajo asíncrono. Por tanto, ambos totales se reducen a la mitad y la diferencia mantiene la misma proporción. El procesamiento por lotes es el mayor descuento individual de cualquiera de las dos plataformas, y una canalización nocturna de documentos siempre puede utilizarlo.
Claude pierde por la misma lógica de niveles que antes. La extracción de campos con un esquema fijo es exactamente el tipo de trabajo que un modelo pequeño realiza bien, y la entrada representa el 97% de los tokens en este caso. Bajar un nivel multiplica por 0.1 la tarifa de entrada de OpenAI y por 0.5 la tarifa de entrada de Claude. Prueba el modelo pequeño con 200 documentos antes de asumir que necesitas el modelo más grande, usando la misma evaluación que ejecutarías para elegir el nivel adecuado de Claude para un trabajo.
Escenario tres: un agente de programación siempre activo
Un desarrollador ejecuta un agente en un VPS, con aproximadamente 900 turnos del modelo al mes. Cada turno incluye unos 60,000 tokens de entrada de contexto del repositorio. El 80% corresponde a aciertos de caché. Además, genera aproximadamente 1,800 tokens de cambios y explicaciones. Calcula el precio con la categoría frontier, porque en programación una diferencia de capacidad tiene un coste real.
Claude factura 116.10, frente a 124.20 de OpenAI. La tarifa de entrada es la misma, la tarifa de lectura de caché también, y la tarifa de salida más baja de Claude supone una ventaja de aproximadamente el 7%.
Ese 7% está dentro del margen de error del tokenizador mencionado antes. Por tanto, considera que este escenario es un empate en las tarifas. Lo que no es un empate es el modelo de facturación. Para un desarrollador con este volumen, una suscripción por usuario suele costar menos que las llamadas a la API con facturación por uso. La comparación cambia por completo cuando se incluye una suscripción. Analiza la comparación entre el coste de la API y el de la suscripción antes de poner un agente en facturación por uso. Si usas facturación por uso, identifica primero dónde se consumen los tokens, porque el uso de tokens de un agente de programación está dominado por el contexto que se vuelve a enviar en cada turno, no por el código que escribe.
Los multiplicadores que determinan la factura
La tarifa anunciada es el elemento más pequeño de esta lista. Cada factor de los siguientes modifica una factura real más que la diferencia entre los dos proveedores en el mismo nivel.
Entrada en caché. Ambos proveedores cobran el 10% de la entrada base cuando se usa la caché. Anthropic también cobra por escribir en la caché: 1.25 veces la entrada base para una entrada de cinco minutos y 2 veces para una entrada de una hora. Una lectura posterior actualiza esa entrada al precio de lectura. Por tanto, una entrada de cinco minutos se amortiza después de una lectura. Una carga de trabajo con intervalos largos entre solicitudes escribe con más frecuencia de la que lee; en ese caso, la caché cuesta más de lo que ahorra. El tráfico constante aprovecha bien la caché. El tráfico en ráfagas no.
Descuentos por lotes. Descuento del 50% en la entrada y la salida en ambas plataformas, solo para trabajos asíncronos. Si el trabajo puede esperar, esto reduce a la mitad la factura con cualquiera de los dos proveedores y se combina con la caché.
Proporción de salida. Claude cobra 5 veces su tarifa de entrada por la salida. OpenAI cobra 6 veces. Cuanto mayor sea la proporción de tokens escritos frente a los leídos, más favorable resulta Claude con la misma tarifa de entrada. Lo contrario se aplica a los trabajos dominados por la entrada.
Reintentos. Un reintento vuelve a pagar toda la entrada y no devuelve nada utilizable. Si el 6% de las llamadas no supera la validación del esquema y se reintenta, el componente de entrada es un 6% mayor de lo previsto. Registra los reintentos como una línea de costes, no como una línea de errores. Los equipos suelen detectar este multiplicador al final y, con frecuencia, es mayor que la diferencia entre proveedores por la que discutieron durante una semana.
Quién pierde y en qué ámbito
Claude pierde claramente en el nivel pequeño. gpt-5.6-luna cobra 0.2 por millón de tokens de entrada, frente a 1 de Claude Haiku 4.5. La salida cuesta 1.2, frente a 5. La clasificación de gran volumen y la extracción breve cuestan aproximadamente cuatro veces más con Claude.
Claude pierde en el nivel de uso general a partir del 1 de septiembre de 2026, cuando termina la tarifa introductoria y Sonnet 5 pasa a 3 y 15, frente a un gpt-5.6-terra sin cambios. Claude gana en el nivel de vanguardia por la tarifa de salida, aunque el margen puede desaparecer según el recuento de tokens. Ningún proveedor gana en trabajos dominados por la entrada durante agosto de 2026, porque a 2 por millón en ambos lados, los costes de entrada son iguales.
Cómo medir esto en tu propio tráfico
Lee el objeto usage en cada respuesta y almacena cuatro valores por solicitud: tokens de entrada, tokens de salida, tokens leídos de la caché y tokens escritos en la caché. En Claude API, esos valores llegan como input_tokens, output_tokens, cache_read_input_tokens y cache_creation_input_tokens. Súmalos por día, multiplícalos por las tarifas actuales y compara el total con la factura. Una diferencia entre ambos valores suele deberse a reintentos o a una ruta de código que olvidaste desplegar.
Realiza la comparación con una semana de tráfico real en lugar de usar una solicitud de muestra, y compara el costo por tarea completada en vez del costo por token. Un modelo que responde en un intento con el doble de tarifa es más barato que un modelo que necesita tres intentos con la mitad de tarifa. El costo por token es una tarifa. El costo por tarea completada es lo que pagas.
Establece un límite máximo de gasto antes de dejar cualquier proceso en ejecución. Ambas plataformas ofrecen límites de gasto en sus consolas, y un agente atascado en un bucle de reintentos puede consumir durante la noche el presupuesto de un mes. Configúralo como lo harías para el control de costos en un agente siempre activo. Si estás creando la primera versión en un servidor que administras, una primera aplicación de Claude API en un VPS explica la gestión de claves y el bucle de solicitudes sobre los que se basa este cálculo.
FAQ
¿La API de Claude es más barata que la API de ChatGPT?
No de forma constante. En agosto de 2026, los niveles de vanguardia y de uso general cobran lo mismo por token de entrada en ambos servicios, y Claude cobra menos por token de salida, por lo que Claude resulta unos pocos puntos porcentuales más barato en cargas de trabajo con muchas salidas. En el nivel pequeño, gpt-5.6-luna de OpenAI cuesta una quinta parte que Claude Haiku 4.5 por token de entrada, por lo que la clasificación de gran volumen es mucho más barata en OpenAI. Calcula tu propia cifra a partir de tu propia distribución de tokens, porque una diferencia tan pequeña depende de tu carga de trabajo y no de la lista de precios.
¿Por qué las mismas palabras cuestan un número diferente de tokens en cada API?
Porque cada modelo tiene su propio tokenizador y el recuento de tokens depende del modelo. Anthropic documenta que Claude 4.7 y los modelos posteriores generan aproximadamente un 30% más de tokens para el mismo texto que Claude Sonnet 4.6 y los modelos anteriores. Envía tu propio texto al endpoint de recuento de tokens de cada proveedor, divide un recuento por el otro y multiplica esa proporción por la tarifa publicada antes de comparar. Una diferencia del 20% en el número de tokens supera la mayoría de las diferencias entre las tarifas publicadas.
¿El almacenamiento en caché de prompts puede aumentar el importe de la factura?
Sí, en Anthropic. Escribir en la caché cuesta 1.25 veces la tarifa base de entrada para una entrada de cinco minutos y 2 veces para una entrada de una hora, mientras que un acceso a la caché cuesta 0.1 veces. Si el tráfico es lo bastante intermitente como para que la mayoría de las entradas caduquen antes de que se lean, pagas el recargo de escritura y no obtienes ninguna lectura. Compara cache_creation_input_tokens con cache_read_input_tokens en los logs. Una proporción cercana a 1 significa que la caché te está costando dinero, así que prolonga la duración de la entrada o elimínala.
¿Debo ejecutar un agente de programación mediante la API o con una suscripción?
Para un desarrollador con un volumen normal, una suscripción suele costar menos que la facturación de la API por uso, porque un agente de programación reenvía un contexto grande en cada turno y ese contexto se factura cada vez. Mide el uso durante una semana y compara el total de la API con el precio de la suscripción. La API resulta más conveniente cuando el uso es irregular o cuando necesitas acceso programático que una suscripción no proporciona.