SSD Nodes Learn 🎉 VPS desde $4.99/mes
Guías Matt ConnorPor Matt Connor · Actualizado 2026-08-13

Claude vs ChatGPT API: cual es mas barato

Compara Claude y ChatGPT API con la formula de tokens y tres trabajos con costes reales. En agosto de 2026, el nivel pequeno de Claude puede costar varias veces mas.

La respuesta breve

La comparación de precios de las API de Claude y ChatGPT no tiene un ganador único, porque los dos proveedores aplican precios diferentes al procesamiento de entrada y de salida en cada nivel. En agosto de 2026, los dos niveles superiores de Claude cobran lo mismo por token de entrada que sus equivalentes de OpenAI y menos por token de salida, por lo que Claude resulta ligeramente más económico en trabajos con mucho contenido de salida. En el nivel pequeño, Claude cuesta varias veces más por el mismo trabajo. Cualquier respuesta que no indique un nivel y una combinación de tokens es una suposición.

Por eso, esta página empieza con los cálculos, continúa con tres cargas de trabajo con sus combinaciones de tokens y termina con los multiplicadores que pueden modificar una factura real más que la tarifa anunciada.

La única fórmula que necesita

Ambas API cobran el texto de la misma manera. Paga por los tokens que envía y paga una tarifa más alta por los tokens que el modelo devuelve.

cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate

Un token equivale aproximadamente a 4 caracteres en inglés, cerca de 0.75 palabras. Use este valor sólo para una primera estimación. Para calcular el importe real, use los recuentos que cada API devuelve en el objeto usage de cada respuesta.

# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
    return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate

# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))

El script muestra 0.005, es decir, medio centavo por turno. Multiplíquelo por el número de turnos que espera realizar en un mes y obtendrá un presupuesto. Si la unidad de un millón de tokens de ese denominador le resulta abstracta, qué puede comprar realmente un millón de tokens en Claude muestra una cantidad concreta de texto. Aprenda esta fórmula y cada cambio de precio posterior a hoy se convertirá en una edición de una sola línea, en lugar de requerir un análisis nuevo.

Las tarifas publicadas, agosto de 2026

Estos son los precios de lista que ambos proveedores publicaron el 1 de agosto de 2026. Este bloque es el único lugar del artículo donde se indica un precio. Compruébelo en claude.com/pricing y en la página de precios de OpenAI antes de aprobar un presupuesto.

ChartList prices in US dollars per million tokens, August 2026
The data behind this chart
[
  {
    "label": "Frontier",
    "claude_input": 5,
    "claude_output": 25,
    "openai_input": 5,
    "openai_output": 30
  },
  {
    "label": "Workhorse",
    "claude_input": 2,
    "claude_output": 10,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Workhorse from September",
    "claude_input": 3,
    "claude_output": 15,
    "openai_input": 2,
    "openai_output": 12
  },
  {
    "label": "Small",
    "claude_input": 1,
    "claude_output": 5,
    "openai_input": 0.2,
    "openai_output": 1.2
  }
]

Las correspondencias se establecen por posición en cada catálogo, no por popularidad. En la gama Frontier se comparan Claude Opus 5 y gpt-5.6-sol. En la gama Workhorse se comparan Claude Sonnet 5 y gpt-5.6-terra. En la gama Small se comparan Claude Haiku 4.5 y gpt-5.6-luna. Ambos proveedores también venden niveles superiores a los de este bloque, y OpenAI mantiene las generaciones anteriores con sus tarifas originales. En Claude, ese nivel es Fable 5. Su precio duplica el de la fila Frontier tanto para entrada como para salida, pero mantiene la misma proporción de cinco veces para la salida. Por eso conviene leer cuánto cuesta Fable 5 y cuándo justifica esa tarifa antes de suponer que Opus 5 es el nivel máximo de su factura. Comparar un modelo insignia de un proveedor con un modelo económico del otro produce una cifra sin significado. Así es como la mayoría de las comparativas publicadas obtiene su titular.

Hay dos aspectos de ese bloque que conviene dejar claros. Las tarifas 2 y 10 de Sonnet 5 son tarifas introductorias, y Anthropic documenta que terminan el 31 de agosto de 2026. Después, Sonnet 5 cobra 3 y 15. Este único cambio convierte el nivel Workhorse de una ventaja limitada para Claude en una ventaja clara para OpenAI, y se produce dentro del periodo de vigencia de este artículo.

El segundo aspecto es un patrón que conviene memorizar: Claude fija el precio de la salida exactamente en 5 veces su propia tarifa de entrada en todas las filas anteriores, mientras que OpenAI fija la salida en 6 veces. Esa proporción, y no la tarifa absoluta, es lo que hace que el ganador cambie según la combinación de tokens.

Por qué una tarifa por millón de tokens no permite comparar proveedores

Una tarifa es una cantidad de dólares por token. El importe se calcula multiplicando los dólares por token por el número de tokens. El número de tokens de un texto depende del modelo, no del texto.

Anthropic lo documenta directamente: los modelos Claude 4.7 y posteriores, incluidos Claude Opus 5 y Claude Sonnet 5, usan un tokenizador más reciente que produce aproximadamente un 30% más de tokens para el mismo texto que Claude Sonnet 4.6 y anteriores. La tarifa no cambió. El importe sí.

Por tanto, dos tarifas que parecen idénticas no generan necesariamente el mismo importe. Cuente los tokens en ambos lados con sus propios textos antes de confiar en cualquier comparación, incluida esta.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached contract."}]
  }'

Una respuesta correcta es un objeto JSON pequeño que contiene input_tokens. Un 401 indica que la variable de clave está vacía en su shell. Procese el mismo texto con el tokenizador del otro proveedor, divida un recuento por el otro y multiplique esa proporción por la tarifa publicada antes de comparar. Si la proporción favorece a un proveedor por más de aproximadamente 1.2, ese factor supera cualquier diferencia de tarifas del bloque anterior.

Escenario uno: una función de chat

Un asistente de soporte integrado en una aplicación web. 120,000 turnos al mes. Cada turno envía un prompt del sistema, esquemas de herramientas, dos fragmentos recuperados de la mesa de ayuda y algunos mensajes anteriores, unos 1,400 tokens de entrada. El modelo responde con unos 220 tokens. Es interactivo, por lo que el descuento por procesamiento por lotes nunca puede aplicarse aquí. Ejecútelo en el nivel de trabajo intensivo.

ChartChat feature, monthly cost in US dollars, 120,000 turns
The data behind this chart
[
  {
    "label": "List price",
    "claude_usd": "600.00",
    "openai_usd": "652.80"
  },
  {
    "label": "Cached prefix",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Small tier, cached",
    "claude_usd": "213.60",
    "openai_usd": "48.00"
  }
]

Al precio de lista, Claude factura 600.00, frente a 652.80 de OpenAI. Los componentes de entrada son idénticos porque las tarifas de entrada son idénticas. Toda la diferencia está en la salida, y Claude la gana por un margen demasiado pequeño como para elegir un proveedor basándose en él.

Ahora marque 800 de esos 1,400 tokens de entrada como un prefijo estable: el prompt del sistema y los esquemas de herramientas, que no cambian entre turnos. Ambos proveedores cobran el 10% de su tarifa de entrada base por un acierto de caché. La factura de Claude baja a 427.20 y la de OpenAI a 480.00. El almacenamiento en caché aporta más ahorro que la elección del proveedor, y ambas plataformas lo ofrecen.

Aquí es donde Claude pierde. La mayoría de las respuestas de soporte no necesitan un modelo de trabajo intensivo. Traslade el mismo tráfico al nivel pequeño: Claude factura 213.60, mientras que OpenAI factura 48.00. Divida una cifra por la otra y verá que Claude cuesta aproximadamente cuatro veces y media más para el mismo trabajo. Claude Haiku 4.5 cobra 1 por millón de tokens de entrada, frente a 0.2 de gpt-5.6-luna, y ningún nivel de almacenamiento en caché elimina una diferencia de cinco veces. Si su carga de trabajo encaja con un modelo pequeño, OpenAI es más barato y el margen es amplio.

Escenario dos: una canalización de documentos con contexto largo

25,000 contratos al mes. Cada solicitud incluye la misma instrucción de 9,000 tokens y el mismo esquema JSON, seguida de 12,000 tokens de texto contractual. El modelo devuelve unos 700 tokens de campos estructurados. La salida representa menos del 4% de los tokens de este trabajo, y ese único dato decide la comparación.

ChartMonthly cost in US dollars, three workloads, cached and paired like-for-like
The data behind this chart
[
  {
    "label": "Chat feature",
    "claude_usd": "427.20",
    "openai_usd": "480.00"
  },
  {
    "label": "Document pipeline",
    "claude_usd": "820.00",
    "openai_usd": "855.00"
  },
  {
    "label": "Coding agent",
    "claude_usd": "116.10",
    "openai_usd": "124.20"
  }
]

Con el prefijo de 9,000 tokens almacenado en caché en ambos proveedores, Claude factura 820.00 y OpenAI factura 855.00. Los costes de entrada coinciden hasta el último centavo, porque las tarifas de entrada base coinciden en agosto de 2026. Toda la diferencia está en la salida, cuyo precio es 5 veces el de la entrada en Claude y 6 veces en OpenAI.

Este trabajo también se puede procesar por lotes. Ambos proveedores aplican un descuento del 50% a la entrada y la salida en trabajos asíncronos, por lo que ambos totales se reducen a la mitad y la diferencia mantiene la misma proporción. Batch es el mayor descuento individual de cualquiera de las dos plataformas, y una canalización nocturna de documentos siempre puede utilizarlo.

Claude pierde por la misma lógica de niveles que antes. La extracción de campos con un esquema fijo es exactamente el tipo de trabajo que un modelo pequeño realiza bien, y la entrada representa el 97% de los tokens en este caso. Bajar un nivel multiplica por 0.1 la tarifa de entrada de OpenAI y por 0.5 la tarifa de entrada de Claude. Pruebe el modelo pequeño con 200 documentos antes de dar por hecho que necesita el modelo más grande, usando la misma evaluación que aplicaría para elegir el nivel de Claude adecuado para un trabajo.

Escenario tres: un agente de programación siempre activo

Un desarrollador ejecuta un agente en un VPS, con aproximadamente 900 turnos del modelo al mes. Cada turno incluye unos 60,000 tokens de entrada de contexto del repositorio. El 80% corresponde a aciertos de caché. Además, genera unos 1,800 tokens de modificaciones y explicación. Use la tarifa de nivel frontier, porque en programación una diferencia de capacidad tiene un coste real.

Claude factura 116.10, frente a 124.20 de OpenAI. La tarifa de entrada y la tarifa de lectura de caché son las mismas. La tarifa de salida más baja de Claude supone una ventaja de aproximadamente el 7%.

Ese 7% está dentro del margen de error del tokenizer indicado anteriormente. Por tanto, considere que este escenario está empatado en tarifas. La diferencia está en el modelo de facturación. Para un desarrollador con este volumen, una suscripción por usuario normalmente cuesta menos que las llamadas a la API medidas por uso. La comparación cambia por completo cuando se incluye una suscripción. Revise la comparación entre el coste de la API y el de una suscripción antes de usar un agente con facturación por uso. Si mide el consumo, determine primero dónde se usan los tokens, porque el uso de tokens de un agente de programación está dominado por el contexto que se vuelve a enviar en cada turno, no por el código que escribe.

Los multiplicadores que determinan la factura

La tarifa anunciada es el elemento más pequeño de esta lista. Cada uno de los siguientes cambia una factura real más que la diferencia entre los dos proveedores en el mismo nivel.

Entrada en caché. Ambos proveedores cobran el 10% de la entrada base cuando hay una coincidencia en la caché. Anthropic también cobra por escribir en la caché: 1.25 veces la entrada base para una entrada de cinco minutos y 2 veces para una entrada de una hora. Una coincidencia posterior renueva esa entrada al precio de lectura. Por tanto, una entrada de cinco minutos se amortiza después de una lectura. Una carga de trabajo con intervalos largos entre solicitudes escribe más veces de las que lee; en ese caso, la caché cuesta más de lo que ahorra. El tráfico constante se beneficia de la caché. El tráfico en ráfagas no.

Descuentos por lotes. Hay un descuento del 50% en la entrada y la salida en ambas plataformas, sólo para trabajos asíncronos. Si el trabajo puede esperar, la factura se reduce a la mitad con cualquiera de los dos proveedores. Además, este descuento se combina con la caché.

Proporción de salida. Claude cobra 5 veces su tarifa de entrada por la salida. OpenAI cobra 6 veces. Cuantos más tokens se escriban en lugar de leerse, más favorable resulta Claude con una tarifa de entrada igual. Lo contrario se aplica a los trabajos dominados por la entrada.

Reintentos. Un reintento vuelve a cobrar toda la entrada y no devuelve nada utilizable. Si el 6% de las llamadas no supera la validación del esquema y se reintenta, el componente de entrada es un 6% mayor de lo previsto en el plan. Registre los reintentos como una línea de coste, no como una línea de errores. Los equipos suelen detectar este multiplicador al final, y a menudo es mayor que la diferencia entre proveedores por la que discutieron durante una semana.

Qué lado pierde y dónde

Claude pierde claramente en el nivel pequeño. gpt-5.6-luna cobra 0.2 por millón de tokens de entrada, frente a 1 de Claude Haiku 4.5. En la salida, los precios son 1.2 frente a 5. La clasificación de gran volumen y la extracción breve cuestan aproximadamente cuatro veces más con Claude.

Claude pierde en el nivel de uso general a partir del 1 de septiembre de 2026, cuando termina la tarifa introductoria y Sonnet 5 pasa a 3 y 15, frente a un gpt-5.6-terra sin cambios. Claude gana en el nivel de frontera por precio de salida, pero la diferencia puede desaparecer con sus propios recuentos de tokens. Ningún lado gana en las cargas de trabajo dominadas por la entrada durante agosto de 2026, porque a 2 por millón en ambos lados, los precios de entrada son iguales.

Cómo medir esto con su propio tráfico

Lea el objeto usage en cada respuesta y almacene cuatro valores por solicitud: tokens de entrada, tokens de salida, tokens leídos de la caché y tokens escritos en la caché. En Claude API, esos valores aparecen como input_tokens, output_tokens, cache_read_input_tokens y cache_creation_input_tokens. Súmelos por día, multiplíquelos por las tarifas actuales y compare el total con la factura. Una diferencia entre ambos valores suele deberse a reintentos o a una ruta de código que olvidó que había publicado.

Realice la comparación durante una semana de tráfico real, no con una solicitud de prueba, y compare el coste por tarea completada en lugar del coste por token. Un modelo que responde en un intento con una tarifa dos veces mayor resulta más barato que un modelo que necesita tres intentos con la mitad de tarifa. El coste por token es una tarifa. El coste por tarea completada es lo que paga.

Establezca un límite máximo de gasto antes de dejar cualquier proceso en ejecución. Ambas plataformas ofrecen límites de gasto en sus consolas, y un agente atascado en un bucle de reintentos puede gastar en una noche el presupuesto de un mes. Configure esta medida como lo haría para el control de costes en un agente siempre activo. Si está creando la primera versión en un servidor propio, una primera aplicación de Claude API en un VPS explica la gestión de claves y el bucle de solicitudes sobre los que se basa este cálculo.

FAQ

¿Es más barata la API de Claude que la API de ChatGPT?

No de forma constante. En agosto de 2026, los niveles frontier y workhorse cobran lo mismo por token de entrada en ambos servicios, y Claude cobra menos por token de salida, por lo que Claude resulta unos pocos puntos porcentuales más barato en trabajos con muchas salidas. En el nivel pequeño, gpt-5.6-luna de OpenAI cuesta una quinta parte que Claude Haiku 4.5 por token de entrada, por lo que la clasificación de gran volumen es mucho más barata en OpenAI. Calcule su propia cifra con su propia combinación de tokens, porque una diferencia tan pequeña depende más de su carga de trabajo que de la lista de precios.

¿Por qué las mismas palabras cuestan una cantidad distinta de tokens en cada API?

Porque cada modelo tiene su propio tokenizador y el recuento de tokens depende del modelo. Anthropic documenta que Claude 4.7 y los modelos posteriores producen aproximadamente un 30% más de tokens para el mismo texto que Claude Sonnet 4.6 y los modelos anteriores. Envíe su propio texto al endpoint de recuento de tokens de cada proveedor, divida un recuento entre el otro y multiplique esa proporción por la tarifa publicada antes de comparar. Una diferencia del 20% en el número de tokens supera la mayoría de las diferencias entre tarifas publicadas.

¿El almacenamiento en caché de prompts puede aumentar el importe de la factura?

Sí, en Anthropic. Escribir una entrada en la caché cuesta 1.25 veces la tarifa base de entrada si dura cinco minutos y 2 veces si dura una hora, mientras que una lectura desde la caché cuesta 0.1 veces esa tarifa. Si el tráfico llega en ráfagas y la mayoría de las entradas caduca antes de que se lean, paga el recargo de escritura sin obtener ninguna lectura. Compare cache_creation_input_tokens con cache_read_input_tokens en sus registros. Una proporción cercana a 1 significa que la caché le está costando dinero, así que prolongue la duración de la entrada o elimínela.

¿Debo ejecutar un agente de programación con la API o con una suscripción?

Para un desarrollador con un volumen normal, una suscripción suele costar menos que la facturación de la API por consumo, porque un agente de programación reenvía un contexto grande en cada turno y ese contexto se cobra cada vez. Mida el consumo durante una semana y compare después el total de la API con el precio de la suscripción. La API resulta ventajosa cuando el uso es irregular o cuando necesita acceso programático que una suscripción no ofrece. Si lo que le llevó a usar la API fue alcanzar un límite de uso y no el precio, las opciones para salir de un límite de uso de Claude incluyen varias alternativas que cuestan menos que pasar a la facturación por consumo.

#claude#openai#api-pricing#tokens#cost-comparison