Límite de Claude alcanzado: qué hacer después
¿Aparece «Claude usage limit reached»? Identifica si es el límite móvil de 5 horas o el semanal y elige modelo menor, menos contexto, créditos o API.
Qué límite de Claude alcanzaste
El mensaje de límite alcanzado de Claude indica la ventana que debe esperar, y esa ventana determina lo que puede hacer después. Los límites de sesión y semanales se aplican a todos los modelos a la vez, por lo que cambiar de modelo no restaura el acceso. Un límite que menciona un solo modelo es la excepción: cambie de modelo y podrá seguir trabajando mientras ese modelo permanece bloqueado.
Claude Code muestra la ventana y la hora de restablecimiento en la misma línea:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pmLa ventana de sesión es de cinco horas móviles. Las ventanas semanales se restablecen a una hora fija cada semana asignada a su cuenta, por lo que el día y la hora son los mismos de una semana a otra. Un plan Pro tiene la ventana de sesión de cinco horas y un límite semanal que se aplica a todos los modelos. Un plan Max añade un segundo límite semanal que se aplica únicamente a una familia de modelos. Los límites concretos se detallan en el desglose completo de los límites de uso de Claude. Esta página comienza donde termina ese desglose.
Este es el punto que suele causar confusión. Cada solicitud cuenta al mismo tiempo para la ventana de sesión y la ventana semanal, por lo que una tarde de uso intensivo puede agotar la asignación semanal mientras la ventana de cinco horas todavía tiene capacidad. Consulte la hora de restablecimiento antes de planificar el resto del día. Un restablecimiento a las 3:45pm equivale a una pausa breve. Un restablecimiento el lunes a medianoche no.
Consulta el consumo antes de hacer suposiciones
En claude.ai, abra Settings y después Usage. Las barras de progreso muestran cuánto ha consumido de la ventana de sesión de cinco horas y de cada ventana semanal. Así puede ver cuál está agotada en lugar de hacer suposiciones.
En Claude Code, ejecute /usage. Muestra las mismas barras del plan y un desglose del destino del consumo reciente. El consumo se atribuye a skills, subagents, plugins y servidores MCP (model context protocol) individuales como porcentaje del total. Pulse d para consultar las últimas 24 horas y w para consultar los últimos 7 días. También señala cualquier patrón que represente el 10% o más del consumo reciente. Los dos patrones que verá con más frecuencia son los contextos largos y los fallos de caché.
Hay dos aspectos que debe tener en cuenta. El desglose se calcula a partir del historial de sesiones almacenado en ese equipo. Por tanto, no incluye el trabajo realizado en otro portátil ni en claude.ai. Además, la cifra en dólares del bloque Session, situado en la parte superior, usa las tarifas estándar de lista para usuarios de API (application programming interface). Por tanto, no corresponde a su factura si tiene una suscripción.
¿Cambiar a un modelo más pequeño ayuda?
Sólo cuando el mensaje menciona un modelo. Después de You've hit your Opus limit, ejecute /model, seleccione Sonnet o Haiku y la sesión continuará con todo el contexto. Después de You've hit your session limit o You've hit your weekly limit, /model no cambia nada, porque esas ventanas se comparten entre todos los modelos.
El cambio resulta mucho más útil antes de llegar al límite que después. Sonnet resuelve la mayoría de las tareas de programación a una fracción del coste de Opus, por lo que dejar Opus como modelo predeterminado es uno de los dos hábitos que explican la mayoría de los consumos inesperados. El otro es mantener una sesión sin borrar nunca. Asigne las ediciones mecánicas y el análisis inicial de logs a Haiku, y reserve Opus para la decisión de diseño en la que realmente esté bloqueado. Elegir entre Opus, Sonnet y Haiku explica en qué casos justifica su precio cada modelo.
Deje de pagar por contexto que ya no utiliza
Claude Code envía toda la conversación con cada solicitud. Además, cada vez que Claude utiliza una herramienta, envía otra solicitud con ese lote de resultados de la herramienta. La caché de prompts hace que el historial se vuelva a leer con la tarifa de caché en lugar de la tarifa completa de entrada. Esto reduce el coste, pero no lo elimina. Por tanto, una pregunta de una sola línea en una sesión abierta desde la mañana sigue consumiendo recursos por toda la conversación.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear no cuesta nada porque descarta el contexto en lugar de leerlo. /compact tiene que leer la conversación que resume, por lo que compactar un contexto muy grande genera una solicitud grande. Use /clear cuando cambie a un trabajo no relacionado. Use /compact sólo cuando esté trabajando en una tarea y necesite conservar el hilo. Ejecute /rename antes de borrar el contexto para poder volver a encontrar la sesión con /resume.
La duración de la caché es más importante de lo que suele parecer. En una suscripción, la caché dura una hora. Se reduce a cinco minutos cuando utiliza créditos de consumo. Cinco minutos también es el valor predeterminado con una API key. El primer mensaje después de una pausa larga no encuentra la caché y vuelve a procesar todo el contexto con la tarifa completa de entrada. Por eso el consumo suele aumentar sin una causa visible. Cuándo resulta rentable la caché de prompts explica el cálculo.
Hay otras tres opciones en el mismo lugar. /mcp muestra los servidores configurados para que pueda desactivar los que no necesita para esta tarea. Un archivo CLAUDE.md largo se carga al iniciar la sesión, aunque el trabajo no lo necesite. Por tanto, mueva las instrucciones especializadas a skills, que sólo se cargan cuando se invocan. Además, el extended thinking se factura como tokens de salida, que son la parte más cara. Redúzcalo con /effort, desactívelo en /config o establezca MAX_THINKING_TOKENS=8000 en un modelo con un presupuesto fijo para el razonamiento.
Divide el trabajo para que quepa en una sola ventana
Pulsa Shift+Tab para cambiar al modo de planificación antes de realizar un cambio importante. Claude explora el código base y propone un enfoque para que lo apruebes. Detectar allí una dirección incorrecta cuesta un plan, no dos horas de cambios más el trabajo de rehacerlos.
Delega las operaciones que generan mucho contenido en subagentes. Ejecutar una suite de pruebas o leer un registro de 10,000 líneas dentro de un subagente mantiene la salida sin procesar en el contexto de ese subagente. Sólo el resumen vuelve a la conversación principal.
Pulsa Escape en cuanto Claude tome una dirección incorrecta. /rewind restaura la conversación y el código a un punto de control anterior. Así no tienes que pagar por deshacer trabajo que nunca necesitaste.
¿Debe comprar créditos de uso o utilizar la API?
Los créditos de uso permiten que una cuenta Pro o Max siga funcionando después de agotar el límite del plan. Se facturan con las tarifas estándar de la API. Actívelos en Settings y después en Usage en claude.ai, con un método de pago asociado. También puede ejecutar /usage-credits en Claude Code; el comando abre la configuración de facturación en el navegador. Los créditos se aplican a las conversaciones de Claude y al uso del terminal de Claude Code, con un límite diario de canje de $2000. El comando requiere iniciar sesión mediante una suscripción. Por eso, no está disponible si se autentica con una API key.
La otra opción es utilizar una API key normal de Claude Console. Se factura por token y no tiene ninguna ventana de sesión ni semanal. Hay un problema habitual: una variable ANTHROPIC_API_KEY residual en el entorno hace que Claude Code utilice esa clave en lugar de la suscripción, sin indicarlo. Puede detectarlo en la factura o con este comando:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.El error 429 indica el límite de velocidad de la clave, no el del plan. Ejecute /status y confirme que la credencial activa sea la que desea utilizar.
¿Cuánto cuesta una tarde en la API?
El ejemplo desarrollado a continuación corresponde a una tarde de programación con agentes: 200,000 tokens de entrada sin caché, 1.8 millones de lecturas desde la caché y 150,000 tokens de salida. Los precios son las tarifas públicas de Anthropic vigentes en agosto de 2026. Todas esas tarifas se expresan por millón de tokens. Si esa unidad todavía resulta abstracta, cuánto vale realmente un millón de tokens la convierte en una cantidad de texto leído y escrito que se puede visualizar.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]La misma tarde cuesta $5.65 con Opus 5 y $1.13 con Haiku 4.5. La salida es lo que determina el total: a $25 por millón de tokens en Opus 5 frente a $5 en Haiku 4.5, los 150,000 tokens que escribe Claude cuestan más que los 2 millones de tokens que lee. Por eso, reducir el presupuesto de razonamiento ahorra más que recortar archivos.
Conviene tener en cuenta una fecha. Sonnet 5 tiene precios promocionales de $2 y $10 por millón de tokens de entrada y salida hasta el 31 de agosto de 2026. El 1 de septiembre de 2026, esos precios pasan a $3 y $15, lo que aumenta el coste de la misma tarde de $2.26 a unos $3.39.
Cómo se calcula cada cifra de una tarde
Opus 5: 200,000 tokens de entrada sin caché a $5 por millón cuestan $1.00. 1.8 millones de lecturas desde la caché, a una décima parte de la tarifa de entrada, cuestan $0.90. 150,000 tokens de salida a $25 por millón cuestan $3.75. Total: $5.65.
Sonnet 5: $0.40 de entrada sin caché, $0.36 de lecturas desde la caché y $1.50 de salida. Total: $2.26.
Haiku 4.5: $0.20 de entrada sin caché, $0.18 de lecturas desde la caché y $0.75 de salida. Total: $1.13.
Las 3 filas suponen los mismos recuentos de tokens, por lo que las diferencias entre ellas se deben únicamente al precio. Una tarde real varía según cuánto de su contexto permanezca en la caché.
Para ponerlo en contexto, la documentación de Anthropic sitúa el gasto medio de Claude Code en implementaciones empresariales cerca de $13 por desarrollador y día activo, y por debajo de $30 por día activo para el 90% de los usuarios, según los datos de agosto de 2026. La facturación por token no es automáticamente más barata que una suscripción. Resulta ventajosa cuando la carga es irregular, porque los días sin actividad no cuestan nada, y deja de serlo cuando se trabaja todos los días. La API frente a una suscripción, comparada con cifras reales muestra el punto de equilibrio.
Ejecute tareas largas durante la noche en un VPS
Algunas tareas no requieren supervisión: una refactorización grande, una migración de pruebas o una revisión completa de la documentación. Estas tareas tampoco necesitan consumir la ventana de su suscripción. Ejecútelas en un VPS (servidor privado virtual) con una clave de API. Así consumirán la facturación por token y conservará intacto el límite de su plan para el trabajo interactivo del día siguiente.
Instale Claude Code en un equipo con Ubuntu y confirme que se ejecuta:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version debería mostrar una cadena de versión como 2.1.211 (Claude Code). Un command not found en este punto significa que ~/.local/bin todavía no está en su PATH. Abra un shell nuevo y vuelva a intentarlo.
Guarde la clave en un archivo en lugar de dejarla en el historial del shell. Cree ~/.claude-env con un editor e incluya una sola línea, export ANTHROPIC_API_KEY=sk-ant-your-key-here. Después, restrinja sus permisos y cárguela:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10La última línea muestra los primeros 10 caracteres. Esto basta para confirmar que la variable está definida sin mostrar la clave completa en pantalla.
Ahora inicie la tarea dentro de tmux para que siga ejecutándose aunque cierre el portátil:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonDesconéctese con Ctrl-b y después d, y cierre la conexión. Vuelva a conectarse más tarde con tmux attach -t overnight. Claude Code en una sesión de tmux en un VPS explica detalladamente la gestión de sesiones.
--bare es importante en este caso. Omite la detección automática de hooks, skills, plugins y CLAUDE.md. Tampoco lee las credenciales de OAuth. Por tanto, la ejecución usa la clave de API y nada más. Esto evita que la tarea consuma su suscripción. También elimina las reglas del proyecto. Por eso --append-system-prompt-file las proporciona de forma explícita. Sin --bare, un conjunto ANTHROPIC_API_KEY activa un mensaje de aprobación único que una ejecución desatendida no puede responder.
Por la mañana, lea el resultado y el coste desde el JSON:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonClaude Code sale con el código 0 cuando la ejecución tiene éxito y con un código distinto de 0 cuando falla. Por tanto, un script envolvente puede evaluar el estado de salida y enviarle por correo el fallo. Establezca un límite de gasto para el workspace en Claude Console antes de dejarlo ejecutándose. Un agente atrapado en un bucle de reintentos a las 3 de la madrugada puede generar un gasto real. Reduzca CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY si también quiere ralentizarlo. Control de costes para agentes que deja ejecutándose explica los límites que conviene configurar primero.
Asigne a la tarea un usuario sin privilegios propio y una rama de git independiente. Un agente que edita un repositorio sin supervisión hará ocasionalmente algo que usted habría detenido. Una rama convierte ese caso en un git checkout, no en un incidente. Ejecución segura de un agente de programación en un VPS explica cómo aislarlo.
Para trabajos masivos que no son interactivos, como clasificar miles de registros, Batch API procesa las solicitudes de forma asíncrona con un descuento del 50% en los tokens de entrada y salida. Es la opción con el menor coste por token que publica Anthropic, y una ejecución nocturna ofrece exactamente la latencia que requiere.
Qué no recupera tu acceso
Iniciar una conversación nueva no restaura tu cuota. El uso se descuenta de tu cuenta, no de una conversación. Sí hace que cada mensaje posterior sea más barato, porque una conversación nueva no tiene historial que volver a leer. Por eso sigue siendo útil. Reduce el coste, pero no restablece la cuota.
Eliminar conversaciones antiguas no devuelve nada. Esos tokens se consumieron cuando se procesaron.
Cambiar de modelo después de alcanzar el límite de una sesión o del límite semanal no sirve de nada, porque esos límites se comparten entre todos los modelos. Sólo responde un mensaje que indique un modelo a /model.
Reintentar en un bucle no sirve de nada y sólo mantiene ocupado el terminal. La hora de restablecimiento que aparece en el mensaje es la respuesta real, y /usage mostrará la misma hora sin el error.
FAQ
¿Cuánto falta para que se restablezca mi límite de Claude?
El mensaje se lo indica. Los límites de sesión funcionan en una ventana móvil de cinco horas y el mensaje muestra una hora, como resets 3:45pm. Los límites semanales se restablecen a una hora fija cada semana, asignada a su cuenta, y el mensaje muestra el día, como resets Mon 12:00am. Para ver ambas barras y las dos horas de restablecimiento antes de alcanzar cualquier límite, ejecute /usage en Claude Code, o abra Settings y después Usage en claude.ai.
¿Cambiar a Sonnet me permitirá seguir trabajando?
Sólo cuando el mensaje indique un modelo. Después de You've hit your Opus limit, ejecute /model, elija otro modelo y la sesión continuará con el contexto intacto. Después de You've hit your session limit o You've hit your weekly limit, elegir otro modelo no cambia nada, porque esas ventanas cuentan todos los modelos conjuntamente. Cambiar a un modelo más barato antes de alcanzar el límite es lo que realmente prolonga la ventana.
¿Iniciar un chat nuevo restablece mi límite de uso?
No. El uso se contabiliza en su cuenta, por lo que un chat nuevo empieza con la misma cantidad disponible restante. Sin embargo, cada mensaje posterior cuesta menos, porque una conversación nueva no contiene historial que Claude deba volver a leer. /clear en Claude Code hace lo mismo y no cuesta nada, mientras que /compact debe leer la conversación que resume, por lo que compactar una sesión muy grande es, en sí mismo, una solicitud costosa.
¿La API es más barata que actualizar mi plan?
Depende de lo constante que sea su uso. La sesión de trabajo de una tarde descrita en esta página cuesta $2.26 con Sonnet 5 y $1.13 con Haiku 4.5, según las tarifas de lista de agosto de 2026. Una suscripción es una tarifa fija por una cantidad limitada de uso, por lo que resulta más conveniente si trabaja la mayoría de los días. La facturación por token resulta más conveniente cuando la carga es irregular, porque los días sin uso no le cuestan nada.
¿Puedo mantener un trabajo en ejecución mientras espero el restablecimiento?
Sí, si lo ejecuta fuera de su suscripción. Ejecútelo en un VPS con ANTHROPIC_API_KEY definido en el entorno; se facturará por token en lugar de consumir la ventana de su plan, por lo que ambas cosas nunca competirán. claude --bare -p dentro de tmux sobrevive al cierre de la tapa del portátil, y --output-format json escribe un campo total_cost_usd que puede comprobar por la mañana con jq.