¿La API de Claude tiene un nivel gratuito?
La API de Claude no tiene nivel gratuito: solo ofrece créditos iniciales sin importe publicado. Consulta las tarifas de julio de 2026 y el costo de una app pequeña.
¿La API de Claude tiene un nivel gratuito?
La API de Claude no tiene un nivel gratuito. No existe una asignación mensual de tokens gratuitos ni un plan que pueda usar por $0. Las cuentas nuevas reciben una pequeña cantidad de créditos gratuitos para probar la API, pero Anthropic no publica el importe. Cuando se consumen esos créditos, cada solicitud utiliza un saldo que debe haber pagado.
Esa es la respuesta directa. El resto de esta guía explica sus consecuencias: qué partes de la plataforma no tienen ningún costo, por qué esta cuestión es diferente del plan gratuito de las aplicaciones de Claude y cuál es la forma más económica y realista de poner en funcionamiento el primer programa.
Qué es gratuito en una cuenta de Claude API
Varias funciones de la plataforma no generan cargos por tokens y son más importantes de lo que parece.
- Conteo de tokens. El endpoint de conteo de tokens es gratuito. Tiene su propio límite de solicitudes por minuto, independiente de la creación de mensajes, por lo que medir un prompt nunca consume el presupuesto para enviarlo.
- La Console. Crear una organización, consultar la página de uso y abrir Workbench no tiene costo. Ejecutar un prompt en Workbench es una solicitud API normal, por lo que esa parte factura tokens como cualquier otra llamada.
- Operaciones con archivos. Subir, enumerar y eliminar archivos mediante la Files API es gratuito. Solo paga cuando el contenido de un archivo entra en una solicitud como tokens de entrada.
- Web fetch. La herramienta web fetch no añade cargos aparte de los tokens del contenido que incorpora a la conversación. Web search no es gratuito: cuesta $10 por 1,000 búsquedas desde julio de 2026.
- Ejecución de código, hasta cierto límite. Cada organización obtiene 1,550 horas gratuitas de contenedor al mes desde julio de 2026. Después, el costo es de $0.05 por hora y por contenedor. La ejecución de código no tiene un costo adicional cuando se ejecuta junto con web search o web fetch.
Nada de esto constituye un nivel gratuito. Significa que la medición es clara: paga por la inferencia, no por la infraestructura auxiliar.
Calcule el precio de un prompt antes de pagar por él
Como el recuento es gratuito, primero puede conocer el tamaño exacto de una solicitud. Este es el mismo endpoint que usan los SDK y acepta el mismo cuerpo que un mensaje real.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-4-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'Una respuesta correcta es una sola línea de JSON: {"input_tokens": 14}. Multiplique ese valor por la tarifa de entrada de su modelo para conocer el costo de la solicitud antes de enviarla. Si recibe HTTP 401 con authentication_error, la clave es incorrecta o fue revocada. El recuento funciona incluso si la cuenta ya no tiene crédito, porque no se genera ningún contenido.
Por qué esta pregunta es diferente del plan gratuito de las aplicaciones
La gente busca ambas cosas, pero casi no tienen relación entre sí. El plan gratuito de las aplicaciones de Claude es un producto real que puede usar durante mucho tiempo sin tarjeta. Se mide mediante una ventana de uso móvil. Qué incluye realmente el nivel gratuito de Claude explica qué ofrece y cuándo se restablece. La API usa un sistema de medición prepago y no tiene un plan equivalente.
La consecuencia que suele causar confusión es que una suscripción y una clave de API son saldos independientes. Pagar Pro no financia una clave. Los créditos de la API no aumentan el límite de uso del chat. Si está eligiendo entre ambas opciones en lugar de intentar evitar cualquier pago, Coste de la API de Claude frente a una suscripción explica los cálculos con cargas de trabajo reales.
Cuánto cuesta una solicitud cuando se agotan los créditos
Estas son las tarifas de la API oficial a fecha de julio de 2026, por millón de tokens.
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5, intro rate",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]Haiku 4.5 cobra 1 dólar por millón de tokens de entrada y 5 dólares por millón de tokens de salida. Opus 5 cobra 5 y 25 por los mismos volúmenes, por lo que el modelo elegido cambia el coste en 5x antes de ajustar el prompt. La cifra de Sonnet 5 es una tarifa introductoria vigente hasta el 31 de agosto de 2026. Después, vuelve a $3 y $15. La salida cuesta cinco veces más que la entrada en todos ellos. Este es el dato más útil de esta página: una respuesta extensa cuesta más que una pregunta larga. qué modelo de Claude deberías usar los compara con un trabajo de ejemplo.
Las formas reales más baratas de experimentar
Cuatro medidas hacen casi todo el trabajo y ninguna requiere un descuento.
- Empieza con el modelo más pequeño que supere tu prueba. La clasificación, la extracción, el etiquetado y el enrutamiento rara vez necesitan un modelo de vanguardia. Haiku 4.5 cuesta una quinta parte que Opus 5 y responde más rápido.
- Establece un límite para
max_tokens. Es el límite máximo de los tokens generados, y la salida es la parte más cara. Un clasificador que responde con una palabra no debería tener un presupuesto de 16,000 tokens. - Almacena en caché la parte del prompt que nunca cambia. Una lectura de caché cuesta el 10% del precio base de entrada y una escritura de caché de cinco minutos cuesta 1.25x, por lo que la caché se amortiza después de una sola lectura. La caché compara prefijos. Por eso, el texto estable debe ir primero y la pregunta variable al final. De lo contrario, no hay coincidencia y pagas el recargo de escritura sin obtener ningún beneficio.
- Procesa por lotes todo lo que no sea interactivo. Message Batches API ofrece un descuento del 50% tanto en la entrada como en la salida, y la mayoría de los lotes termina en menos de una hora. Los trabajos nocturnos, las cargas históricas y las ejecuciones de evaluación deben usar esta opción.
Un cálculo de costos para una primera aplicación pequeña
Tomemos un script de resumen de registros: 1,000 llamadas, cada una con unos 800 tokens de entrada correspondientes a líneas de registros y unos 200 tokens de salida correspondientes al resumen. En Haiku 4.5, son 800,000 tokens de entrada y 200,000 tokens de salida.
The data behind this chart
[
{
"label": "Standard rates",
"cost_usd": "1.80"
},
{
"label": "Same job on the Batch API",
"cost_usd": "0.90"
}
]El cálculo es 0.8 millones de tokens de entrada a $1 más 0.2 millones de tokens de salida a $5, lo que da un total de 1.80 dólares. Si se envía como lote, el mismo trabajo cuesta 0.90. Un saldo de crédito inicial permite realizar muchas pruebas a esa escala. Por eso, la ausencia de un nivel gratuito se vuelve problemática mucho más tarde de lo que suele esperarse. Para consultar el procedimiento completo en un servidor propio, crear una primera aplicación de Claude API en un VPS explica la gestión de claves, el streaming y las rutas de error.
Los niveles de uso son límites máximos, no saldos disponibles
La API asigna automáticamente a cada organización un nivel de uso según el historial de uso y el estado de la cuenta. Los niveles se denominan Start, Build, Scale y Custom. Cada nivel establece límites de velocidad y un límite máximo de gasto mensual. En julio de 2026, los límites máximos son de $500 en Start, $1,000 en Build y $200,000 en Scale. Custom no tiene límite máximo.
Interprételo como un límite, no como un crédito. Estar en el nivel Start no significa que tenga $500 disponibles para gastar. Significa que no puede gastar más de $500 en un mes natural. Cuando alcanza ese límite, el uso se pausa hasta el mes siguiente. También puede establecer su propio límite de gasto, inferior al límite del nivel. Esto es lo primero que debe hacer en cualquier cuenta asociada a una tarjeta, porque un bucle descontrolado es una causa mucho más frecuente de pérdidas económicas que el precio por token.
Qué hacer si lo gratuito es un requisito estricto
Si el presupuesto es realmente cero y debe mantenerse así, la API no es la herramienta adecuada. Comparar planes no cambia esa conclusión. Quedan dos opciones honestas. Use el plan gratuito de las aplicaciones de Claude para el trabajo interactivo, aceptando que tiene límites por ventana y no ofrece un endpoint programable. O ejecute un modelo de pesos abiertos en hardware alquilado. Así sustituye el coste por token por el coste de un servidor que puede controlar: ejecutar Ollama en un VPS para alojar un LLM de forma autónoma explica cuánta memoria necesita cada tamaño de modelo y qué pueden hacer realmente los modelos pequeños.
Para cualquier caso intermedio, la respuesta práctica es usar una clave con fondos, establecer un límite de gasto bajo, elegir un modelo pequeño y activar el almacenamiento en caché de prompts desde el primer día.
FAQ
¿La API de Claude es gratuita?
No. No existe un nivel gratuito ni una asignación mensual de tokens gratuitos. Las cuentas nuevas reciben una pequeña cantidad de créditos gratuitos para probar la API. Después, cada solicitud consume créditos prepagados o el crédito de una tarjeta registrada. Algunas funciones de la plataforma no tienen coste, como el recuento de tokens, la carga y eliminación de archivos, y la herramienta de obtención web, sin contar los tokens del contenido que obtiene.
¿Recibo créditos gratuitos al registrarme en la API de Claude?
Sí, recibes una pequeña cantidad, pero Anthropic no publica la cifra. Considérala suficiente para comprobar que la integración funciona, no como un presupuesto sobre el que puedas basarte. El crédito adicional para evaluaciones empresariales se gestiona a través del equipo de ventas de Anthropic y no se concede automáticamente.
¿La suscripción a Claude Pro o Max incluye acceso a la API?
No. La suscripción y la clave de API se facturan por separado y se miden de forma diferente. Pro y Max aumentan tu asignación dentro de las aplicaciones de Claude. Una clave de API consume créditos prepagados y está limitada por minuto según el número de solicitudes y de tokens. Si necesitas ambos servicios, debes pagar ambos.
¿Cuál es la forma más económica de probar la API de Claude?
Cuenta primero los tokens, porque ese endpoint es gratuito. Después, ejecuta la prueba con Haiku 4.5 y un max_tokens ajustado, almacena en caché cualquier prompt de sistema fijo para que las llamadas repetidas se facturen al 10% del precio de entrada y envía todo lo que no sea interactivo mediante Batch API, con la mitad del precio. Con estos ajustes, mil llamadas pequeñas cuestan algo más de un dólar en julio de 2026.