SSD Nodes Learn Hosting plans →
Guías Matt ConnorPor Matt Connor · Actualizado 2026-09-01

¿La API de Claude tiene un nivel gratuito?

La API de Claude no ofrece nivel gratuito: incluye un crédito inicial pequeño y funciones sin coste. Consulta las tarifas de julio de 2026 y calcula tu primera app.

¿La API de Claude tiene un nivel gratuito?

La API de Claude no tiene un nivel gratuito. No incluye una cantidad mensual de tokens sin coste ni un plan que pueda mantener por $0. Las cuentas nuevas reciben una pequeña cantidad de créditos gratuitos para probar la API, pero Anthropic no publica el importe. Cuando se agotan esos créditos, cada solicitud consume un saldo que debe haber pagado.

Esa es la respuesta directa. El resto de esta guía explica sus consecuencias: qué partes de la plataforma no tienen ningún coste, por qué esta cuestión es distinta del plan gratuito de las aplicaciones de Claude y cuál es la forma más económica y transparente de poner en funcionamiento el primer programa.

Qué es gratuito en una cuenta de Claude API

Varias funciones de la plataforma no consumen tokens de pago, y son más importantes de lo que parece.

  • Contar tokens. El endpoint de recuento de tokens se puede usar de forma gratuita. Tiene su propio límite de solicitudes por minuto, separado del límite de creación de mensajes, por lo que medir un prompt nunca reduce el presupuesto para enviarlo.
  • La propia Console. Crear una organización, consultar la página de uso y abrir Workbench no tiene ningún coste. Ejecutar un prompt en Workbench es una solicitud API normal, por lo que esa parte factura tokens como cualquier otra llamada.
  • Operaciones con archivos. Subir, enumerar y eliminar archivos mediante Files API es gratuito. Sólo se paga cuando el contenido de un archivo entra en una solicitud como tokens de entrada.
  • Web fetch. La herramienta web fetch no añade ningún cargo más allá de los tokens del contenido que incorpora a la conversación. Web search no es gratuito: cuesta $10 por 1,000 búsquedas desde julio de 2026.
  • Ejecución de código, hasta cierto límite. Cada organización recibe 1,550 horas gratuitas de contenedor al mes desde julio de 2026. Después, el coste es de $0.05 por hora y contenedor. La ejecución de código no tiene ningún coste adicional cuando se ejecuta junto con web search o web fetch.

Nada de esto constituye un nivel gratuito. Significa que la medición es transparente: se factura la inferencia, no la infraestructura auxiliar. Web fetch gratuito resulta útil con fuentes de datos que también son gratuitas, y ejecutar análisis de acciones y opciones con una API de datos de mercado sin clave es un ejemplo completo en el que lo único que se paga son los tokens que los datos obtenidos incorporan al prompt.

Solicite un precio antes de pagarlo

Como el recuento es gratuito, primero puede conocer el tamaño exacto de una solicitud. Este es el mismo endpoint que utilizan los SDK y acepta el mismo cuerpo que un mensaje real.

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-haiku-4-5",
    "system": "You are a scientist",
    "messages": [{"role": "user", "content": "Hello, Claude"}]
  }'

Una respuesta correcta es una sola línea de JSON: {"input_tokens": 14}. Multiplique ese valor por la tarifa de entrada de su modelo para conocer el coste de la solicitud antes de enviarla. Si obtiene HTTP 401 con authentication_error, la clave es incorrecta o ha sido revocada. Si la clave parece correcta y la llamada sigue sin autenticarse, o accede a Claude mediante Bedrock, Vertex o Foundry en lugar de usar una clave de Anthropic, las cuatro formas de autenticar un cliente explica qué necesita cada método y dónde guardar la credencial. El recuento funciona incluso en una cuenta sin crédito, porque no se genera nada.

Por qué esta es una pregunta distinta del plan gratuito de las aplicaciones

La gente busca ambas cosas, pero casi no tienen relación entre sí. El plan gratuito de las aplicaciones de Claude es un producto real que puede usar durante mucho tiempo sin tarjeta y cuyo uso se mide mediante una ventana móvil. Qué incluye realmente el nivel gratuito de Claude explica qué ofrece y cuándo se restablece. La API usa medición prepago y no incluye ningún plan de ese tipo.

La consecuencia que suele confundir a los usuarios es que una suscripción y una clave de API son saldos independientes. Pagar Pro no financia una clave, y los créditos de la API no aumentan el límite de uso del chat. Claude Code es donde esta separación genera más confusión, porque puede funcionar con cualquiera de las dos opciones: Si Claude Code está incluido con Pro explica qué planes lo cubren y cuándo pasa silenciosamente a facturar una clave. Si está eligiendo entre ambas opciones en lugar de intentar evitar cualquier pago, Coste de Claude API frente a una suscripción desarrolla el cálculo con cargas de trabajo reales. La excepción es Claude Enterprise, que incluye en la misma factura un precio por puesto y el uso de tokens medido con las tarifas de la API. Cómo funciona el precio por puesto de Enterprise explica qué cubre el mínimo de puestos antes de que comience la medición.

Qué cuesta una petición cuando se agotan los créditos

Estas son las tarifas de la API oficial a fecha de julio de 2026, por millón de tokens.

ChartClaude API rates per million tokens, July 2026
The data behind this chart
[
  {
    "label": "Haiku 4.5",
    "input_usd": 1,
    "output_usd": 5
  },
  {
    "label": "Sonnet 5, intro rate",
    "input_usd": 2,
    "output_usd": 10
  },
  {
    "label": "Opus 5",
    "input_usd": 5,
    "output_usd": 25
  }
]

Haiku 4.5 cobra 1 dólar por millón de tokens de entrada y 5 dólares por millón de tokens de salida. Opus 5 cobra 5 y 25 por los mismos volúmenes, por lo que el modelo elegido puede multiplicar por 5 el coste antes de ajustar el prompt. La tarifa de Sonnet 5 es promocional y se mantiene hasta el 31 de agosto de 2026. Después volverá a $3 y $15. La salida cuesta cinco veces más que la entrada en los tres modelos. Este es el dato más útil de esta página: una respuesta extensa cuesta más que una pregunta larga. qué modelo de Claude debería usar los compara con un trabajo de ejemplo. Fable 5 está por encima de los tres: cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Por eso conviene concretar qué compran realmente esas tarifas antes de asignarle cualquier tarea rutinaria.

Los caminos reales más baratos para experimentar

Cuatro medidas hacen casi todo el trabajo y ninguna requiere un descuento.

  • Empiece con el modelo más pequeño que supere su prueba. La clasificación, la extracción, el etiquetado y el enrutamiento rara vez necesitan un modelo de vanguardia. Haiku 4.5 cuesta una quinta parte que Opus 5 y responde más rápido.
  • Limite max_tokens. Es el límite máximo de tokens generados y la salida es la parte más cara. Un clasificador que responde con una sola palabra no debería tener un presupuesto de 16,000 tokens.
  • Almacene en caché la parte del prompt que nunca cambia. Una lectura de caché cuesta el 10% del precio base de entrada y una escritura de caché de cinco minutos cuesta 1.25x, por lo que la caché se amortiza con una sola lectura. La caché busca coincidencias de prefijo. Por tanto, el texto estable debe aparecer primero y la pregunta variable al final. De lo contrario, no habrá coincidencias y pagará el recargo de escritura sin obtener ningún beneficio.
  • Procese por lotes todo lo que no sea interactivo. Message Batches API ofrece un descuento del 50% tanto en la entrada como en la salida, y la mayoría de los lotes terminan en menos de una hora. Los trabajos nocturnos, las cargas retroactivas y las ejecuciones de evaluación deben utilizar este sistema.

Un cálculo de costes para una primera aplicación pequeña

Tomemos un script de resumen de registros: 1,000 llamadas, cada una con unos 800 tokens de entrada correspondientes a líneas de registro y con unos 200 tokens de salida de resumen. Son 800,000 tokens de entrada y 200,000 tokens de salida en Haiku 4.5.

Chart1,000 calls at 800 input and 200 output tokens, Haiku 4.5
The data behind this chart
[
  {
    "label": "Standard rates",
    "cost_usd": "1.80"
  },
  {
    "label": "Same job on the Batch API",
    "cost_usd": "0.90"
  }
]

El cálculo es de 0.8 millones de tokens de entrada a $1 más 0.2 millones de tokens de salida a $5, lo que da un total de 1.80 dólares. Si se envía como lote, el mismo trabajo cuesta 0.90. Un saldo de crédito inicial cubre muchas pruebas a esa escala, por lo que la ausencia de un nivel gratuito se nota mucho más tarde de lo que suele esperarse. Para consultar el tutorial completo en un servidor propio, crear una primera aplicación de Claude API en un VPS explica la gestión de claves, el streaming y las rutas de error.

Los niveles de uso son límites máximos, no saldos disponibles

La API asigna automáticamente a cada organización un nivel de uso según su historial de uso y el estado de la cuenta. Los niveles se denominan Start, Build, Scale y Custom. Cada uno establece límites de velocidad y un tope de gasto mensual. En julio de 2026, los topes son de $500 en Start, $1,000 en Build y $200,000 en Scale. Custom no tiene tope.

Debe interpretarlo como un límite, no como un crédito. Estar en el nivel Start no significa que tenga $500 disponibles para gastar. Significa que no puede gastar más de $500 en un mes natural. Cuando alcanza ese importe, el uso se pausa hasta el mes siguiente. También puede establecer su propio límite de gasto, inferior al tope del nivel. Esto es lo primero que debe hacer en cualquier cuenta asociada a una tarjeta, porque un bucle descontrolado es una causa mucho más habitual de pérdidas económicas que el precio por token.

Qué hacer si la gratuidad es un requisito estricto

Si el presupuesto es realmente cero y debe seguir siéndolo, la API no es la herramienta adecuada. Ningún cambio de plan modifica esa realidad. Quedan dos opciones honestas. Use el plan gratuito de las aplicaciones de Claude para el trabajo interactivo. Debe aceptar que el uso se mide por ventana y que no tendrá un endpoint programable. La otra opción es ejecutar un modelo de pesos abiertos en hardware alquilado. Así cambia el coste por token por el coste de un servidor que usted controla: ejecutar Ollama en un VPS para alojar un LLM en sus propios sistemas explica cuánta memoria necesita cada tamaño de modelo y qué pueden hacer realmente los modelos pequeños. Si el límite real es la ventana de uso y no el dinero, Claude Pro a $20 al mes eleva ese límite en las aplicaciones por menos que muchas primeras facturas de API. Aun así, no permite realizar llamadas desde código. Decidir si merece la pena pagar esos $20 depende de la frecuencia con la que el límite gratuito le impida trabajar. una guía para decidir sobre Pro lo analiza a partir de patrones de uso reales. Si está comparando proveedores y no planes de una misma línea, planes de Claude y ChatGPT comparados por precio reúne los niveles gratuitos y de pago de ambos servicios, incluido cuál resulta más barato para tareas de programación. Si intenta eliminar del gasto una suscripción que ya está pagando, cancelar o cambiar a un plan inferior conserva el mes que ya ha comprado y evita el siguiente cobro.

Para cualquier situación intermedia, la respuesta práctica es usar una clave con fondos, establecer un límite de gasto bajo, elegir un modelo pequeño y activar el almacenamiento en caché de prompts desde el primer día.

FAQ

¿La API de Claude es gratuita?

No. No tiene un nivel gratuito ni una asignación mensual de tokens sin coste. Las cuentas nuevas reciben una pequeña cantidad de créditos gratuitos para probar la API. Después, cada solicitud consume créditos prepagados o utiliza la tarjeta registrada. Algunas funciones de la plataforma no tienen coste, incluido el recuento de tokens, la carga y eliminación de archivos y la herramienta de obtención de contenido web, aparte de los tokens del contenido que obtiene.

¿Recibo créditos gratuitos al registrarme en la API de Claude?

Sí, una pequeña cantidad. Anthropic no publica la cifra. Considérela suficiente para comprobar que la integración funciona, no como un presupuesto sobre el que pueda basarse. Los créditos de prueba ampliados para evaluar el producto en entornos empresariales se gestionan con el equipo de ventas de Anthropic. No se conceden automáticamente.

¿La suscripción a Claude Pro o Max incluye acceso a la API?

No. La suscripción y la API key se facturan por separado y se miden de forma distinta. Pro y Max amplían su asignación dentro de las aplicaciones de Claude. Una API key consume créditos prepagados y está limitada por minuto según el número de solicitudes y de tokens. Si necesita ambas cosas, debe pagar ambas.

¿Cuál es la forma más barata de probar la API de Claude?

Cuente primero los tokens, porque ese endpoint es gratuito. Después, ejecute la prueba con Haiku 4.5 y un max_tokens ajustado. Almacene en caché cualquier system prompt fijo para que las llamadas repetidas se facturen al 10% del precio de entrada. Envíe mediante la Batch API todo lo que no sea interactivo para pagar la mitad. Con estos ajustes, mil llamadas pequeñas cuestan algo más de un dólar a fecha de julio de 2026.