SSD Nodes Learn Hosting plans →
Guías Matt ConnorPor Matt Connor · Actualizado 2026-10-03

Qué consume tu límite de Claude Pro

Anthropic no publica un número de tokens para Pro. Descubre qué agota el límite: conversaciones largas, archivos, imágenes, esfuerzo y agentes.

Qué consume tu límite de Claude Pro

Anthropic no publica una asignación de tokens para Claude Pro, por lo que nadie puede decirte cuál es tu límite en tokens. Lo que consume ese límite sí se puede determinar y resulta más útil: primero, la longitud de la conversación; después, los archivos adjuntos y las imágenes; luego, el esfuerzo de razonamiento; y, por último, el trabajo con herramientas y agentes.

Un token es un fragmento de texto, aproximadamente una palabra corta o parte de una palabra más larga. Cada solicitud que envías se mide en tokens, y tu plan los contabiliza en segundo plano. La página de Anthropic sobre prácticas recomendadas para el límite de uso identifica los factores que modifican ese recuento: la longitud del mensaje, el tamaño de los archivos adjuntos, la longitud actual de la conversación, el uso de herramientas como Research y la búsqueda web, el modelo elegido, el nivel de esfuerzo y la creación de artifacts. Todos los elementos de esa lista tienen el mismo efecto. Cada uno modifica cuántos tokens contiene una sola solicitud.

Dos preguntas relacionadas tienen sus propias páginas. Cuánto uso incluye un plan Pro explica el tamaño de la asignación y por qué se describe en sesiones en lugar de tokens. Qué hacer cuando alcanzas el límite explica cómo recuperar el acceso. Esta página explica dónde se consumió.

Cada mensaje vuelve a enviar toda la conversación

Este es el mecanismo que sorprende a casi todo el mundo. El modelo no conserva memoria entre turnos. Para responder a su siguiente mensaje, vuelve a leer toda la conversación desde la primera palabra. La documentación de Anthropic lo indica directamente: cada solicitud vuelve a enviar todo el historial de la conversación.

Por tanto, una pregunta de seguimiento de cinco palabras no es una solicitud de cinco palabras. Es todo el hilo más esas cinco palabras.

Conviene hacer las cuentas una vez. Supongamos que cada turno añade unos 500 tokens, contando su mensaje y la respuesta de Claude. El turno 2 envía unos 1,000 tokens. El turno 10 envía unos 5,000. El turno 20 envía unos 10,000, es decir, diez veces lo que costó el turno 2, aunque usted haya escrito la misma cantidad de texto. En veinte turnos, el hilo ha transportado unos 105,000 tokens en total, mientras que las mismas veinte preguntas planteadas en veinte chats nuevos transportarían unos 10,000. Estas cifras son un cálculo, no una medición, pero la proporción es correcta.

Por eso el mismo trabajo visible puede tener costes muy diferentes. Usted escribió las mismas palabras en ambos casos. La diferencia está en cuánto historial había antes de ellas.

Los hilos largos tienen un segundo coste. Cuando una conversación se acerca a la ventana de contexto (200,000 tokens en Pro desde septiembre de 2026), Claude resume los mensajes anteriores para que el chat pueda continuar. Anthropic también indica que las conversaciones que activan esta gestión automática del contexto consumen una mayor parte de su límite de uso. Resumir requiere trabajo real y se descuenta del mismo límite.

Puede observar este proceso. Abra Settings y, después, Usage, donde Pro muestra barras de progreso para la ventana de sesión de cinco horas y la ventana semanal. Envíe el mensaje número 20 de un hilo largo y, después, el primer mensaje de un chat nuevo. Compare cuánto avanza la barra. Cómo funcionan las ventanas de sesión y semanal explica cuándo se reinicia cada una.

¿Cuánto cuesta un archivo o un PDF?

ChartInput tokens counted for four short requests
The data behind this chart
[
  {
    "label": "Text question only",
    "input_tokens": 14
  },
  {
    "label": "One tool definition plus a question",
    "input_tokens": 403
  },
  {
    "label": "One JPEG photo plus a question",
    "input_tokens": 1028
  },
  {
    "label": "One small PDF plus a question",
    "input_tokens": 2188
  }
]

Esos son los resultados de ejemplo que aparecen en la documentación de Anthropic sobre el recuento de tokens, medidos con claude-opus-5. Los cuatro prompts difieren ligeramente, así que debe fijarse en el tamaño de las diferencias y no en las cifras exactas. Una pregunta breve de texto contó 14 tokens de entrada. Una fotografía con una pregunta breve contó 1028. Un PDF pequeño (archivo en formato de documento portátil) con una pregunta breve contó 2188, aproximadamente 150 veces más que la pregunta de texto.

Ahora combine esto con el reenvío explicado antes. Un archivo adjunto se convierte en tokens una sola vez y después se incluye en cada turno posterior de esa conversación. Si adjunta un informe de 40 páginas en el primer mensaje, paga de nuevo por esas 40 páginas en el segundo mensaje, en el tercero y en el vigésimo.

Las cifras publicadas por página son elevadas. En la API (interfaz de programación de aplicaciones), donde se documentan estos valores, una página de PDF suele utilizar entre 1,500 y 3,000 tokens de texto, según su densidad, además del coste de la imagen de la página, porque cada página también se convierte en una imagen. Por tanto, 40 páginas cuestan más de 60,000 tokens antes de que nadie haya hecho una pregunta. En una ventana de contexto de 200,000 tokens, esto ocupa una parte importante del espacio con páginas que quizá no necesite.

Por tanto, el procedimiento es sencillo. Adjunte la parte que necesita, no el archivo completo. Pedir a Claude que lea un informe y encuentre las condiciones de pago cuesta el informe completo en cada turno posterior. Pegar la sección de condiciones de pago cuesta unos cientos de tokens una sola vez.

Por qué las capturas de pantalla cuestan más de lo que parece

ChartVisual tokens for one image, by pixel size and model tier
The data behind this chart
[
  {
    "label": "200 x 200 crop",
    "standard_tokens": 64,
    "high_res_tokens": 64
  },
  {
    "label": "1000 x 1000 screenshot",
    "standard_tokens": 1296,
    "high_res_tokens": 1296
  },
  {
    "label": "1920 x 1080 screenshot",
    "standard_tokens": 1560,
    "high_res_tokens": 2691
  },
  {
    "label": "3840 x 2160 screenshot",
    "standard_tokens": 1560,
    "high_res_tokens": 4784
  }
]

Claude lee una imagen como una cuadrícula de bloques. Cada bloque mide 28 por 28 píxeles y cuenta como un token visual, por lo que el coste de una imagen es el ancho dividido entre 28, redondeado hacia arriba, multiplicado por el alto dividido entre 28, también redondeado hacia arriba. Una captura de pantalla de 1000 por 1000 píxeles cuesta 1296 tokens visuales, más que la pregunta completa de la mayoría de las personas.

El modelo elegido también cambia este valor. Claude 4.7 y los modelos posteriores leen las imágenes con un nivel de resolución mayor, por lo que una captura de pantalla completa en 4K cuesta 4784 tokens visuales, frente a 1560 en un modelo anterior, que reduce primero el tamaño de la imagen. Es el mismo archivo y la misma pantalla, pero consume aproximadamente tres veces más tokens.

La aplicación Claude admite hasta 20 imágenes en un solo mensaje. Veinte capturas de pantalla completas generan una petición muy grande antes de que haya escrito nada, y cada turno posterior de esa conversación vuelve a incluirlas todas. Recorte la imagen. Un recorte de 200 por 200 píxeles que muestre el mensaje de error real cuesta 64 tokens visuales y normalmente responde mejor a la pregunta que una imagen de todo el escritorio.

¿Cuánto cuestan el razonamiento y el nivel de esfuerzo?

El esfuerzo controla cuánto razona Claude antes de responder. En la aplicación de Claude, el ajuste se encuentra en el menú del modelo, junto al botón de envío, y los niveles son bajo, medio, alto, extra alto y máximo. Anthropic explica directamente la contrapartida: un nivel de esfuerzo más alto utiliza más tokens, por lo que se alcanzan antes los límites de uso. La misma página recomienda los niveles bajo o medio para las tareas rutinarias, porque un nivel de esfuerzo menor permite prolongar el uso.

El razonamiento también tiene un efecto posterior. En los modelos que conservan los turnos anteriores, el razonamiento de las respuestas previas cuenta como tokens de entrada en cada turno posterior de esa conversación. Una sesión de razonamiento larga se contabiliza una vez cuando se produce y después se vuelve a contabilizar parcialmente en cada mensaje posterior.

La elección del modelo tiene un segundo efecto que puede pasar desapercibido. El tokenizador, que divide el texto en tokens, cambió con Claude 4.7. El mismo texto de entrada produce aproximadamente un 30 por ciento más de tokens en Claude 4.7 y en los modelos posteriores que en los anteriores. Anthropic no publica cómo se convierten estas cantidades en una parte del límite de Pro, así que considérelo un motivo para usar el ajuste más bajo en las tareas rutinarias, no un tipo de cambio. En la modalidad de pago por uso, el cálculo es público, y los tokens de entrada y salida tienen precios diferentes allí.

Por qué los agentes y Claude Code agotan el límite más rápido

Claude Code y la aplicación de Claude comparten la misma cuota.

Los planes Pro y Max tienen límites de uso compartidos entre Claude y Claude Code. Esto significa que toda la actividad realizada en ambas herramientas cuenta para los mismos límites de uso.

El trabajo de un agente lee mucho más de lo que escribe. Una solicitud para corregir un error puede abrir diez archivos, ejecutar una búsqueda, leer los resultados y responder con cuatro líneas de explicación. Usted ve cuatro líneas. El límite contabiliza todos los archivos que se leyeron hasta llegar a esa respuesta. Esta es la mayor diferencia entre el aspecto de una sesión y su coste real.

Las herramientas también consumen tokens antes de que usted solicite nada, porque la descripción de cada herramienta se envía junto con la petición. En los ejemplos publicados anteriores, una pregunta breve sin herramientas contabilizó 14 tokens de entrada, mientras que una pregunta breve con la definición de una herramienta contabilizó 403. Las configuraciones reales de agentes incluyen muchas más herramientas.

En Claude Code, /status muestra cuánto queda de la sesión. Mantener pequeño el contexto de trabajo es la medida más eficaz que puede aplicar, y gestionar el contexto en una sesión larga de Claude Code explica cómo hacerlo. La sobrecarga que un arnés de agente mantiene antes de su primera instrucción explica el resto de la diferencia.

Por qué el mismo trabajo cuesta más en algunos idiomas

El tokenizador se ajustó principalmente con texto en inglés, por lo que las palabras frecuentes en inglés suelen ocupar un token cada una. El mismo significado escrito en ruso, árabe, hindi o japonés normalmente se divide en más tokens, lo que significa que una pregunta idéntica consume una mayor parte de su límite. El funcionamiento descrito en esta página es el mismo en todos los idiomas. El precio por frase no lo es.

Mida su propio caso en lugar de confiar en una estimación. El endpoint de conteo de tokens de Anthropic se puede usar de forma gratuita y devuelve el número de tokens de entrada de cualquier mensaje:

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "messages": [{"role": "user", "content": "Paste your paragraph here"}]
  }'

La respuesta ocupa una sola línea:

{"input_tokens": 14}

Ejecútelo dos veces: una con un párrafo en inglés y otra con el mismo párrafo en su propio idioma. Después, compare los dos números. La llamada no cuesta nada, pero necesita una clave de API de Claude Console en platform.claude.com. Es una cuenta independiente de su suscripción Pro. Cambiar al inglés normalmente es una mala decisión, porque piensa y escribe más rápido en su propio idioma. En su lugar, mantenga los hilos cortos y los archivos adjuntos pequeños. Esos dos hábitos le benefician más que a un hablante de inglés.

Hábitos para que un plan Pro dure más

  • Inicie una conversación nueva cuando cambie el tema. Es el hábito más importante de la lista, porque la longitud del hilo multiplica el coste de cada mensaje posterior.
  • Adjunte la parte necesaria, no el archivo completo. Tres páginas en lugar de cuarenta.
  • Recorte las capturas de pantalla para mostrar sólo el mensaje de error.
  • Guarde el contexto permanente en un proyecto en lugar de pegarlo en cada chat nuevo. Anthropic indica que el contenido de los proyectos se almacena en caché y no cuenta para sus límites cuando se reutiliza, por lo que una guía de estilo o un esquema deben formar parte del conocimiento del proyecto.
  • Use un nivel de esfuerzo bajo o medio para las preguntas rutinarias y reserve el nivel alto para el trabajo que lo justifique.
  • Formule toda la pregunta en un solo mensaje. Tres rondas de aclaraciones cuestan más que un mensaje detallado, porque cada ronda vuelve a enviar todo lo anterior.

Cuando el límite ya no es suficiente

Pro cuesta $20 al mes con facturación mensual, o $17 al mes con facturación anual, según los precios de septiembre de 2026. Anthropic lo describe como un plan que ofrece al menos cinco veces el uso por sesión de cinco horas que ofrece el plan gratuito. Qué cuesta Pro y qué limita explica el plan en sí. Los hábitos anteriores permiten obtener un uso real y también tienen un límite. Si alcanza el límite una vez al mes, esos hábitos resolverán el problema. Si lo alcanza cada pocos días mientras realiza trabajo remunerado, decidir si Max es la opción adecuada es un uso más rentable de su tiempo.

FAQ

¿Por qué se agotó tan rápido mi límite de Claude Pro hoy?

Casi siempre se debe a una conversación larga, un archivo adjunto o ambas cosas. Cada mensaje vuelve a enviar todo el hilo, por lo que el mensaje veinte cuesta muchas veces más que el mensaje dos, aunque haya escrito el mismo número de palabras. El archivo adjunto también se vuelve a enviar cada vez. Abra Settings y después Usage para comprobar cuánto ha consumido de la sesión de cinco horas y de la ventana semanal. Luego, inicie conversaciones separadas para preguntas no relacionadas.

¿Iniciar una conversación nueva ahorra uso?

Sí. Es el hábito más económico disponible. Un chat nuevo no tiene historial, por lo que el primer mensaje sólo cuesta lo que ha escrito. La contrapartida es que Claude ya no sabe qué se dijo antes. Pegue un resumen breve de la parte útil en lugar de todo el hilo anterior. Pegar la conversación antigua completa en una nueva reconstruye exactamente el problema que intentaba evitar.

¿Los archivos adjuntos siguen consumiendo uso después del primer mensaje?

Sí, dentro de la misma conversación. El archivo se convierte una vez en tokens, y esos tokens pasan a formar parte del historial de la conversación que se incluye en cada turno posterior. Un PDF de 40 páginas permanece en la solicitud hasta que termina el chat. Los archivos colocados en un proyecto son la excepción, porque Anthropic indica que el contenido del proyecto se almacena en caché y no cuenta para los límites cuando se reutiliza.

¿Escribir en un idioma distinto del inglés consume más límite?

Normalmente, sí. El tokenizador divide el texto que no está en inglés en más tokens para expresar el mismo significado. Por eso, una pregunta idéntica cuesta más en ruso o japonés que en inglés. Puede medir la diferencia contando el mismo párrafo en ambos idiomas con el endpoint gratuito de recuento de tokens. Mantenga los hilos cortos y los archivos adjuntos pequeños en lugar de cambiar de idioma. Esos hábitos le permiten ahorrar más que a una persona que escribe en inglés.

¿Claude Code usa el mismo límite que la aplicación Claude?

Sí. Anthropic indica que los límites de uso de Pro y Max se comparten entre Claude y Claude Code. Por tanto, la actividad de ambos cuenta para los mismos límites. Las sesiones de agente lo consumen rápidamente, porque una sola solicitud puede leer muchos archivos y ejecutar varias herramientas antes de responder. Ejecute /status dentro de Claude Code para comprobar cuánto queda de la sesión actual.