¿La API de Claude tiene un nivel gratuito?
La API de Claude no tiene nivel gratuito: ofrece créditos iniciales sin importe publicado. Consulta las tarifas de julio de 2026 y el coste de una primera app.
¿La API de Claude tiene un nivel gratuito?
La API de Claude no tiene un nivel gratuito. No incluye una asignación mensual de tokens gratuitos ni un plan que pueda usar por $0. Las cuentas nuevas reciben una pequeña cantidad de créditos gratuitos para probar la API, pero Anthropic no publica su importe. Cuando se agotan esos créditos, cada solicitud consume saldo prepagado.
Esa es la respuesta directa. El resto de esta guía explica sus consecuencias: qué partes de la plataforma no tienen ningún coste, por qué esta cuestión es diferente del plan gratuito de las aplicaciones de Claude y cuál es la forma más económica y realista de poner en funcionamiento un primer programa.
Qué es gratis en una cuenta de Claude API
Varias funciones de la plataforma no consumen tokens, y son más importantes de lo que parece.
- Contar tokens. El endpoint de conteo de tokens se puede usar gratis. Tiene su propio límite de solicitudes por minuto, independiente de la creación de mensajes. Por tanto, medir un prompt no reduce el presupuesto disponible para enviarlo.
- La Console. Crear una organización, consultar la página de uso y abrir Workbench no tiene ningún coste. Ejecutar un prompt en Workbench es una solicitud API normal, por lo que esa parte factura tokens como cualquier otra llamada.
- Operaciones con archivos. Subir, enumerar y eliminar archivos mediante Files API es gratis. Sólo se paga cuando el contenido de un archivo entra en una solicitud como tokens de entrada.
- Web fetch. La herramienta web fetch no añade ningún cargo aparte de los tokens del contenido que incorpora a la conversación. La búsqueda web no es gratis: cuesta $10 por cada 1,000 búsquedas en julio de 2026.
- Ejecución de código, hasta cierto límite. Cada organización recibe 1,550 horas de contenedor gratuitas al mes en julio de 2026. Después, el coste es de $0.05 por hora y contenedor. La ejecución de código no tiene ningún coste adicional cuando se ejecuta junto con web search o web fetch.
Nada de esto es un nivel gratuito. Significa que la medición de costes es transparente: se factura la inferencia, no la infraestructura auxiliar.
Calcula el precio de una solicitud antes de pagarla
Como el recuento es gratuito, puedes conocer primero el tamaño exacto de una solicitud. Este es el mismo endpoint que utilizan los SDK y acepta el mismo cuerpo que un mensaje real.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-4-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'Una respuesta correcta es una sola línea de JSON: {"input_tokens": 14}. Multiplica ese valor por la tarifa de entrada de tu modelo para conocer el coste de la solicitud antes de enviarla. Si recibes HTTP 401 con authentication_error, la clave es incorrecta o se ha revocado. El recuento funciona incluso en una cuenta sin crédito, porque no se genera ningún contenido.
Por qué esta es una cuestión distinta del plan gratuito de las aplicaciones
La gente busca ambas cosas, pero casi no tienen relación entre sí. El plan gratuito de las aplicaciones de Claude es un producto real que se puede usar durante mucho tiempo sin tarjeta, con un límite basado en una ventana móvil de uso, y qué incluye realmente el nivel gratuito de Claude explica qué ofrece y cuándo se restablece. La API usa medición prepago y no incluye ese plan.
La consecuencia que suele confundir a los usuarios es que una suscripción y una clave de API son saldos independientes. Pagar Pro no financia una clave, y los créditos de la API no aumentan el límite de uso del chat. Si está eligiendo entre ambas opciones en lugar de intentar no pagar, coste de la API de Claude frente a una suscripción explica los cálculos con cargas de trabajo reales. La excepción es Claude Enterprise, que incluye en la misma factura un precio por puesto y el uso de tokens medido con tarifas de API, y cómo funciona el precio por puesto de Enterprise explica qué cubre el mínimo de puestos antes de que empiece la medición.
Cuánto cuesta una solicitud cuando se agotan los créditos
Estas son las tarifas de la API oficial a fecha de julio de 2026, por millón de tokens.
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5, intro rate",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]Haiku 4.5 factura 1 dólares por millón de tokens de entrada y 5 dólares por millón de tokens de salida. Opus 5 factura 5 y 25 para los mismos volúmenes, por lo que el modelo elegido puede multiplicar por 5 el coste antes de ajustar el prompt. La tarifa de Sonnet 5 es promocional y estará vigente hasta el 31 de agosto de 2026; después volverá a ser de $3 y $15. En todos los modelos, la salida cuesta cinco veces más que la entrada. Este es el dato más útil de esta página: una respuesta extensa cuesta más que una pregunta larga. qué modelo de Claude debería usar los compara con un trabajo de ejemplo. Fable 5 supera a los tres con $10 por millón de tokens de entrada y $50 por millón de tokens de salida, así que conviene resolver qué se obtiene realmente con esas tarifas antes de asignarle cualquier tarea rutinaria.
Las formas reales más baratas de experimentar
Cuatro medidas hacen casi todo el trabajo y ninguna requiere un descuento.
- Empiece con el modelo más pequeño que supere su prueba. La clasificación, la extracción, el etiquetado y el enrutamiento rara vez necesitan un modelo de vanguardia. Haiku 4.5 cuesta una quinta parte que Opus 5 y responde más rápido.
- Establezca un límite de
max_tokens. Es el límite máximo de tokens generados, y la salida es la parte más cara. Un clasificador que responde con una palabra no debería tener un presupuesto de 16,000 tokens. - Almacene en caché la parte del prompt que nunca cambia. Una lectura de caché cuesta el 10% del precio base de entrada y una escritura de caché de cinco minutos cuesta 1.25x, por lo que la caché se amortiza después de una sola lectura. La caché compara prefijos. Por eso, el texto estable debe ir primero y la pregunta variable al final. De lo contrario, no habrá coincidencias y pagará el recargo de escritura sin obtener ningún beneficio.
- Procese por lotes todo lo que no sea interactivo. Message Batches API ofrece un descuento del 50% tanto en la entrada como en la salida, y la mayoría de los lotes termina en menos de una hora. Los trabajos nocturnos, las cargas retrospectivas y las ejecuciones de evaluación deben usar este método.
Un cálculo de costes para una primera aplicación pequeña
Tomemos un script de resumen de registros: 1,000 llamadas, cada una con unos 800 tokens de entrada de líneas de registro y unos 200 tokens de salida del resumen. Son 800,000 tokens de entrada y 200,000 tokens de salida en Haiku 4.5.
The data behind this chart
[
{
"label": "Standard rates",
"cost_usd": "1.80"
},
{
"label": "Same job on the Batch API",
"cost_usd": "0.90"
}
]El cálculo es 0.8 millones de tokens de entrada a $1 más 0.2 millones de tokens de salida a $5, lo que da un total de 1.80 dólares. Si se envía como lote, el mismo trabajo cuesta 0.90. Un saldo de crédito inicial permite realizar muchas pruebas a esa escala. Por eso, la ausencia de un nivel gratuito suele notarse mucho más tarde de lo que se espera. Para consultar el procedimiento completo en un servidor propio, crear una primera aplicación de Claude API en un VPS explica la gestión de claves, el streaming y las rutas de error.
Los niveles de uso son límites máximos, no saldos disponibles
La API asigna automáticamente cada organización a un nivel de uso según el historial de uso y el estado de la cuenta. Los niveles se denominan Start, Build, Scale y Custom. Cada uno establece límites de tasa y un límite máximo de gasto mensual. En julio de 2026, los límites son de $500 para Start, $1,000 para Build y $200,000 para Scale. Custom no tiene límite.
Interprételo como un límite, no como un crédito. Estar en el nivel Start no significa que tenga $500 disponibles para gastar. Significa que no puede gastar más de $500 en un mes natural. Cuando alcanza ese importe, el uso se pausa hasta el mes siguiente. También puede establecer un límite de gasto inferior al máximo del nivel. Esto es lo primero que debe hacer en cualquier cuenta asociada a una tarjeta, porque un bucle descontrolado es una forma mucho más habitual de perder dinero que el precio por token.
Qué hacer si lo gratuito es un requisito estricto
Si el presupuesto es realmente cero y debe mantenerse así, la API no es la herramienta adecuada. Comparar planes no cambia ese hecho. Quedan dos opciones honestas. Use el plan gratuito de las aplicaciones de Claude para el trabajo interactivo, aceptando que está limitado por ventana de uso y que no ofrece ningún endpoint programable. O ejecute un modelo de pesos abiertos en hardware alquilado. Así sustituye el coste por token por el coste de un servidor que usted controla: ejecutar Ollama en un VPS para alojar un LLM por cuenta propia explica cuánta memoria necesita cada tamaño de modelo y qué pueden hacer realmente los modelos pequeños. Si descubre que la limitación real es la ventana de uso y no el dinero, Claude Pro por $20 al mes amplía ese límite en las aplicaciones por menos de lo que cuestan muchas primeras facturas de API, aunque sigue sin ofrecer nada que pueda invocar desde código. Si está comparando proveedores y no planes de una misma línea, planes de Claude y ChatGPT comparados por precio reúne los niveles gratuitos y de pago de ambos servicios, incluido cuál resulta más barato para tareas de programación. Y si una suscripción que ya paga forma parte del gasto que intenta reducir a cero, cancelar o cambiar a un plan inferior conserva el mes que ya ha comprado y evita el siguiente cobro.
Para cualquier situación intermedia, la respuesta práctica es usar una clave con fondos, establecer un límite de gasto bajo, elegir un modelo pequeño y activar la caché de prompts desde el primer día.
FAQ
¿La API de Claude es gratuita?
No. No hay un nivel gratuito ni una asignación mensual de tokens sin coste. Las cuentas nuevas reciben una pequeña cantidad de créditos gratuitos para probar la API. Después, cada solicitud consume crédito prepagado o se carga a una tarjeta registrada. Algunas funciones de la plataforma no tienen coste, como el recuento de tokens, la carga y eliminación de archivos, y la herramienta de obtención de contenido web, sin contar los tokens del contenido que obtiene.
¿Recibo créditos gratuitos al registrarme en la API de Claude?
Sí, una pequeña cantidad, pero Anthropic no publica la cifra. Considérela suficiente para comprobar que la integración funciona, no como un presupuesto sobre el que basar el desarrollo. El crédito adicional para evaluaciones empresariales se gestiona con el equipo comercial de Anthropic y no se concede automáticamente.
¿La suscripción a Claude Pro o Max incluye acceso a la API?
No. La suscripción y la clave de API se facturan por separado y se miden de forma diferente. Pro y Max aumentan su asignación dentro de las aplicaciones de Claude. Una clave de API consume créditos prepagados y está limitada por minuto según el número de solicitudes y de tokens. Si necesita ambos servicios, debe pagar ambos.
¿Cuál es la forma más económica de probar la API de Claude?
Cuente primero los tokens, ya que ese endpoint es gratuito. Después, ejecute la prueba con Haiku 4.5 y un max_tokens ajustado, almacene en caché cualquier prompt de sistema fijo para que las llamadas repetidas lean el 10% del precio de entrada y envíe mediante la Batch API todo lo que no sea interactivo, con la mitad del precio. Con esos ajustes, mil llamadas pequeñas cuestan algo más de un dólar en julio de 2026.