Claude 사용량 제한 도달 시 해결 방법 및 확인법
Claude 사용량 제한 메시지가 발생했을 때 세션 및 주간 초기화 시간을 확인하는 방법을 안내합니다. 모델 변경, 컨텍스트 축소, API 전환 등 제한을 우회하여 작업을 지속할 수 있는 실질적인 대안과 Claude Code 사용량 분석 명령어를 상세히 설명합니다.
어떤 Claude 제한에 도달했는지 확인하기
Claude 제한 도달 메시지에는 대기 중인 시간대가 명시되어 있으며, 해당 시간대에 따라 다음 작업 가능 여부가 결정됩니다. 세션 제한과 주간 제한은 모든 모델에 동시에 적용되므로, 모델을 변경해도 사용 권한이 즉시 복구되지 않습니다. 특정 모델 이름이 명시된 제한은 예외입니다. 이 경우 모델을 변경하면 해당 모델이 차단된 상태에서도 계속 작업을 이어갈 수 있습니다.
Claude Code는 제한 시간대와 초기화 시간을 같은 줄에 출력합니다.
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm세션 시간대는 5시간 단위로 갱신되는 롤링 방식입니다. 주간 시간대는 계정에 할당된 매주 고정된 시간에 초기화되므로, 매주 동일한 요일과 시간에 초기화됩니다. Pro 플랜은 5시간 세션 시간대와 모든 모델에 공통으로 적용되는 주간 제한을 포함합니다. Max 플랜은 특정 모델 제품군에만 별도로 적용되는 두 번째 주간 제한을 추가로 제공합니다. 제한 수치 자체는 Claude 사용량 제한 상세 내역에서 확인할 수 있습니다. 이 페이지는 해당 문서의 내용을 보완합니다.
사용자들이 자주 혼동하는 부분은 다음과 같습니다. 모든 요청은 세션 시간대와 주간 시간대에 동시에 반영됩니다. 따라서 오후에 집중적으로 작업하면 5시간 세션 시간대에는 여유가 있더라도 주간 허용량을 모두 소진할 수 있습니다. 남은 일과를 계획하기 전에 초기화 시간을 먼저 확인하십시오. 오후 3시 45분에 초기화된다면 잠시 휴식을 취하면 되지만, 월요일 자정에 초기화된다면 상황이 다를 수 있습니다.
추측하기 전에 사용량을 확인하십시오
claude.ai에서 Settings를 열고 Usage를 선택하십시오. 진행률 표시줄을 통해 5시간 세션 창과 주간 창의 사용량을 각각 확인할 수 있으므로, 무엇이 소진되었는지 추측할 필요 없이 바로 파악할 수 있습니다.
Claude Code에서는 /usage을 실행하십시오. 동일한 계획 표시줄과 함께 최근 사용량이 어디에 소비되었는지에 대한 분석 결과가 표시됩니다. 이는 전체 사용량 대비 스킬, 하위 에이전트, 플러그인, 개별 MCP(model context protocol) 서버별 비율로 나타납니다. 최근 24시간 사용량은 d를, 최근 7일 사용량은 w을 눌러 확인하십시오. 또한 최근 사용량의 10% 이상을 차지하는 패턴을 표시하며, 가장 흔하게 나타나는 두 가지는 긴 컨텍스트와 캐시 미스입니다.
두 가지 주의 사항이 있습니다. 사용량 분석은 해당 기기에 저장된 세션 기록을 바탕으로 계산되므로, 다른 노트북이나 claude.ai 웹에서 수행한 작업은 포함되지 않습니다. 또한 상단 Session 블록에 표시되는 금액은 API(application programming interface) 사용자를 위한 표준 정가 기준이므로, 구독 중인 경우 실제 청구 금액과는 다릅니다.
더 작은 모델로 전환하면 도움이 됩니까?
메시지에서 모델을 지정하는 경우에만 도움이 됩니다. You've hit your Opus limit 이후에 /model를 실행하여 Sonnet이나 Haiku를 선택하면, 모든 컨텍스트가 유지된 상태로 세션이 계속됩니다. You've hit your session limit 또는 You've hit your weekly limit 이후에는 /model를 수행해도 아무런 변화가 없는데, 이는 해당 창이 모든 모델 간에 공유되기 때문입니다.
모델 전환은 한계에 도달한 뒤보다 도달하기 전에 하는 것이 훨씬 유리합니다. Sonnet은 대부분의 코딩 작업을 Opus 비용의 일부만으로 처리할 수 있으므로, Opus를 기본값으로 유지하는 것은 예상치 못한 사용량 급증을 유발하는 두 가지 주요 습관 중 하나입니다. 다른 하나는 세션을 전혀 초기화하지 않는 것입니다. 기계적인 편집이나 로그 분류 작업은 Haiku에 맡기고, 진정으로 막혀 있는 설계 결정 사항에 대해서만 Opus를 사용하십시오. Opus, Sonnet, Haiku 선택하기에서 각 모델이 비용에 상응하는 가치를 발휘하는 상황을 다룹니다.
사용하지 않는 컨텍스트에 비용을 지불하지 마십시오
Claude Code는 모든 요청 시 전체 대화 내용을 전송하며, Claude가 도구를 사용할 때마다 해당 도구 결과물을 포함한 새로운 요청을 보냅니다. 프롬프트 캐싱(Prompt caching)을 사용하면 전체 입력 요금이 아닌 캐시 요율로 기록을 다시 읽으므로 비용이 저렴해지지만, 무료는 아닙니다. 따라서 아침부터 열어둔 세션에서 한 줄짜리 질문을 하더라도 전체 대화 내용에 대한 사용량이 발생합니다.
/context
/clear
/compact Focus on the failing tests and the files we changed/clear은 컨텍스트를 읽지 않고 폐기하므로 비용이 발생하지 않습니다. /compact은 요약할 대화 내용을 읽어야 하므로, 매우 큰 컨텍스트를 압축하는 작업 자체가 큰 요청이 됩니다. 관련 없는 작업으로 넘어갈 때는 /clear을 사용하고, 작업 도중 스레드를 유지해야 할 때만 /compact를 사용하십시오. /resume을 통해 세션을 다시 찾을 수 있도록 삭제하기 전에 /rename을 실행하십시오.
캐시 수명은 예상보다 훨씬 중요합니다. 구독 중에는 캐시가 1시간 동안 유지됩니다. 사용량 크레딧을 소진하기 시작하면 5분으로 단축되며, API 키의 기본값 또한 5분입니다. 긴 점심시간 이후 첫 메시지는 캐시를 놓치고 전체 컨텍스트를 다시 처리하므로 전체 입력 비용이 발생하며, 이것이 눈에 띄는 이유 없이 사용량이 급증하는 원인입니다. 프롬프트 캐싱이 비용 효율적인 경우에서 관련 계산 방식을 다룹니다.
동일한 위치에 세 가지 추가 조절 수단이 있습니다. /mcp는 구성된 서버 목록을 나열하여 현재 작업에 필요하지 않은 서버를 끌 수 있게 합니다. 긴 CLAUDE.md는 작업 필요 여부와 관계없이 세션 시작 시 로드되므로, 호출될 때만 로드되는 기술(skills)로 특수 지침을 옮기십시오. 확장된 사고(extended thinking)는 비용이 높은 출력 토큰으로 청구되므로, /effort으로 낮추거나 /config에서 끄거나, 고정된 사고 예산이 있는 모델에서 MAX_THINKING_TOKENS=8000를 설정하십시오.
작업을 분할하여 한 화면에 맞추기
대규모 변경을 수행하기 전 Shift+Tab을 눌러 계획 모드로 전환하십시오. Claude가 코드베이스를 탐색하고 접근 방식을 제안하면 이를 승인하십시오. 계획 단계에서 잘못된 방향을 발견하면 계획을 수정하는 비용만 발생하지만, 편집을 마친 뒤 재작업을 수행하면 2시간 이상의 시간이 소요됩니다.
복잡한 작업은 서브 에이전트에 위임하십시오. 테스트 스위트를 실행하거나 10,000줄 분량의 로그를 읽는 작업을 서브 에이전트 내부에서 수행하면 원본 출력은 해당 에이전트의 컨텍스트에 유지되고, 요약본만 메인 대화로 반환됩니다.
Claude가 잘못된 방향으로 진행하는 즉시 Escape를 누르십시오. /rewind은 대화와 코드를 이전 체크포인트로 복구하므로, 원치 않는 작업을 되돌리기 위해 비용을 지불할 필요가 없습니다.
사용량 크레딧을 구매해야 합니까, 아니면 API를 사용해야 합니까?
사용량 크레딧을 사용하면 Pro 또는 Max 계정이 요금제 한도를 초과하더라도 표준 API 요금으로 서비스를 계속 이용할 수 있습니다. 결제 수단이 등록된 상태에서 claude.ai의 Settings 메뉴 내 Usage 항목에서 활성화하거나, Claude Code에서 /usage-credits을 실행하여 브라우저의 결제 설정 페이지를 열 수 있습니다. 크레딧은 Claude 대화와 Claude Code 터미널 사용량에 모두 적용되며, 일일 사용 한도는 2000달러입니다. 이 명령어는 구독 계정 로그인이 필요하므로 API 키로 인증한 경우에는 사용할 수 없습니다.
다른 방법은 Claude Console에서 발급받은 일반 API 키를 사용하는 것으로, 세션이나 주간 제한 없이 토큰 단위로 요금이 청구됩니다. 주의할 점은 환경 변수에 ANTHROPIC_API_KEY이 설정되어 있으면 Claude Code가 구독 계정 대신 해당 API 키를 통해 실행된다는 사실을 인지하지 못할 수 있다는 것입니다. 이 경우 청구서를 확인하거나 다음 메시지를 통해 알게 됩니다.
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.여기서 발생하는 429 오류는 요금제 한도가 아닌 API 키의 속도 제한(rate limit) 때문입니다. /status를 실행하여 현재 사용 중인 자격 증명이 의도한 것인지 확인하십시오.
API 사용 시 오후 한나절 비용은 얼마인가?
아래의 작업 예시는 에이전트 방식 코딩으로 보낸 오후 한나절의 작업량입니다. 캐시되지 않은 입력 토큰 200,000개, 캐시 읽기 180만 개, 출력 토큰 150,000개입니다. 가격은 2026년 8월 기준 Anthropic 공시 요금입니다.
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]같은 오후 작업에 대해 Opus 5는 $5.65, Haiku 4.5는 $1.13가 소요됩니다. 전체 비용을 결정짓는 것은 출력 토큰입니다. Opus 5는 백만 토큰당 $25, Haiku 4.5는 $5인 상황에서, Claude가 작성하는 150,000개의 토큰 비용이 읽어 들이는 200만 개의 토큰 비용보다 더 큽니다. 이것이 파일 내용을 줄이는 것보다 생각(thinking) 예산을 줄이는 것이 비용 절감에 더 효과적인 이유입니다.
참고할 날짜가 하나 있습니다. Sonnet 5는 2026년 8월 31일까지 백만 입력/출력 토큰당 각각 $2와 $10의 도입 할인가를 적용하며, 2026년 9월 1일부터는 $3와 $15로 인상됩니다. 이에 따라 같은 오후 작업 비용이 $2.26에서 약 $3.39로 상승하게 됩니다.
오후 작업 비용 산출 방식
Opus 5: 캐시되지 않은 입력 토큰 200,000개(백만 토큰당 $5)는 $1.00입니다. 캐시 읽기 180만 개(입력 요금의 1/10)는 $0.90입니다. 출력 토큰 150,000개(백만 토큰당 $25)는 $3.75입니다. 합계 $5.65.
Sonnet 5: 캐시되지 않은 입력 $0.40, 캐시 읽기 $0.36, 출력 $1.50. 합계 $2.26.
Haiku 4.5: 캐시되지 않은 입력 $0.20, 캐시 읽기 $0.18, 출력 $0.75. 합계 $1.13.
3개의 모든 행은 동일한 토큰 수를 가정하므로, 행 간의 차이는 순수하게 가격 차이입니다. 실제 오후 작업 비용은 컨텍스트가 얼마나 캐시된 상태로 유지되느냐에 따라 달라집니다.
규모를 가늠하기 위해 Anthropic 자체 문서에 따르면, 2026년 8월 기준 기업 환경에서 Claude Code를 사용하는 개발자 1인당 일일 평균 비용은 약 $13이며, 사용자 90%의 경우 일일 $30 미만입니다. 토큰 단위 과금이 구독 방식보다 항상 저렴한 것은 아닙니다. 작업량이 불규칙할 때는 사용하지 않는 날 비용이 발생하지 않아 유리하지만, 매일 작업하는 경우에는 구독 방식이 더 나을 수 있습니다. 실제 수치로 비교한 API와 구독 방식에서 손익분기점을 확인할 수 있습니다.
VPS에서 야간에 긴 작업 실행하기
대규모 리팩토링, 테스트 마이그레이션, 문서 정리와 같이 사용자가 지켜볼 필요가 없는 작업들이 있습니다. 이러한 작업은 구독 중인 대화창을 차지할 필요도 없습니다. API 키를 사용하여 VPS(Virtual Private Server)에서 실행하면 토큰당 과금 방식으로 처리되므로, 내일 사용할 대화형 작업의 플랜 할당량을 그대로 유지할 수 있습니다.
Ubuntu 서버에 Claude Code를 설치하고 정상 작동하는지 확인합니다.
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version 명령은 2.1.211 (Claude Code)과 같은 버전 문자열을 출력해야 합니다. 여기서 command not found가 발생한다면 ~/.local/bin이 아직 PATH에 추가되지 않은 것이므로, 새 셸을 열고 다시 시도하십시오.
키는 셸 기록에 남기지 말고 파일에 저장하십시오. 편집기로 ~/.claude-env 파일을 생성하여 export ANTHROPIC_API_KEY=sk-ant-your-key-here 한 줄을 입력한 다음, 권한을 제한하고 로드합니다.
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10마지막 줄은 키의 처음 10자만 출력합니다. 전체 키를 화면에 노출하지 않고도 변수가 설정되었는지 확인하기에 충분합니다.
이제 노트북을 닫아도 작업이 유지되도록 tmux 내부에서 작업을 시작합니다.
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.jsonCtrl-b를 누른 뒤 d를 눌러 세션을 분리하고 연결을 종료합니다. 나중에 tmux attach -t overnight으로 다시 연결할 수 있습니다. tmux 세션에서 Claude Code 실행하기에서 세션 관리에 대해 자세히 다룹니다.
여기서는 --bare이 중요합니다. 이 옵션은 훅, 스킬, 플러그인, CLAUDE.md의 자동 탐색을 건너뛰며 OAuth 자격 증명을 읽지 않으므로, 오직 API 키만 사용하여 실행됩니다. 이것이 작업을 구독 플랜에서 분리하는 방법입니다. 또한 프로젝트 규칙이 적용되지 않으므로 --append-system-prompt-file을 사용하여 명시적으로 규칙을 다시 전달해야 합니다. --bare가 없으면 ANTHROPIC_API_KEY이 설정된 경우 무인 실행 시 답변할 수 없는 일회성 승인 프롬프트가 나타납니다.
아침에 JSON 파일에서 결과와 비용을 확인합니다.
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonClaude Code는 성공 시 0을, 실패 시 0이 아닌 값을 반환하며 종료합니다. 따라서 래퍼 스크립트를 작성하여 종료 상태에 따라 분기하고 실패 시 메일을 보내도록 설정할 수 있습니다. 작업을 실행하기 전에 Claude Console에서 작업 공간 지출 한도를 설정하십시오. 새벽 3시에 재시도 루프에 빠진 에이전트는 실제 비용을 발생시킬 수 있습니다. 속도를 늦추려면 CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY 값을 낮추십시오. 실행 중인 에이전트의 비용 제어에서 설정해야 할 제한 사항들을 살펴볼 수 있습니다.
작업을 위해 권한이 없는 별도의 사용자를 생성하고 전용 git 브랜치를 사용하십시오. 무인 상태로 저장소를 수정하는 에이전트는 가끔 사용자가 중단시켰을 작업을 수행할 수 있으며, 브랜치를 사용하면 이를 사고가 아닌 git checkout로 처리할 수 있습니다. VPS에서 코딩 에이전트 안전하게 실행하기에서 격리 방법을 다룹니다.
수천 개의 레코드를 분류하는 것과 같이 대화형이 아닌 대량 작업의 경우, Batch API를 사용하면 요청을 비동기적으로 처리하며 입력 및 출력 토큰 모두 50% 할인된 가격이 적용됩니다. 이는 Anthropic이 제공하는 가장 저렴한 토큰당 처리 경로이며, 야간 시간대는 이 방식이 요구하는 지연 시간에 정확히 부합합니다.
접근 권한이 복구되지 않는 경우
새로운 대화를 시작한다고 해서 사용 한도가 복구되지는 않습니다. 사용량은 대화 단위가 아니라 계정 단위로 계산됩니다. 다만, 새로운 대화는 이전 기록을 다시 읽을 필요가 없으므로 이후에 이어지는 모든 메시지의 비용이 절감됩니다. 따라서 새 대화를 시작하는 것은 여전히 유효한 방법입니다. 이는 비용 절감일 뿐, 한도 초기화가 아닙니다.
오래된 대화를 삭제해도 환불되는 것은 없습니다. 해당 토큰은 처리되는 시점에 이미 소모되었습니다.
세션이나 주간 메시지 제한 이후에 모델을 변경해도 아무런 효과가 없습니다. 해당 제한은 모든 모델에서 공유되기 때문입니다. 모델을 명시하는 메시지만이 /model에 응답합니다.
반복적으로 재시도하는 것은 터미널을 바쁘게 만들 뿐 아무런 도움이 되지 않습니다. 메시지에 표시된 초기화 시간이 실제 정답이며, /usage를 실행하면 오류 메시지 없이 동일한 타이머를 확인할 수 있습니다.
FAQ
Claude 사용 제한은 언제 초기화됩니까?
메시지에 초기화 시각이 표시됩니다. 세션 제한은 5시간 단위의 롤링 윈도우 방식으로 운영되며, 메시지에 resets 3:45pm와 같은 시각이 나타납니다. 주간 제한은 계정별로 할당된 매주 특정 시간에 초기화되며, 메시지에 resets Mon 12:00am와 같은 요일이 표시됩니다. 제한에 도달하기 전에 두 가지 막대와 초기화 시각을 모두 확인하려면 Claude Code에서 /usage을 실행하거나, claude.ai의 Settings에서 Usage를 확인하십시오.
Sonnet으로 전환하면 다시 사용할 수 있습니까?
메시지에 특정 모델이 언급된 경우에만 그렇습니다. You've hit your Opus limit 이후에는 /model를 실행하여 다른 모델을 선택하면 컨텍스트를 유지한 채 세션을 계속할 수 있습니다. You've hit your session limit 또는 You've hit your weekly limit 이후에는 모델 선택이 아무런 영향을 주지 않는데, 이는 해당 제한이 모든 모델의 사용량을 합산하여 계산하기 때문입니다. 제한에 도달하기 전에 더 저렴한 모델로 전환하는 것이 실제로 사용 가능 시간을 늘리는 방법입니다.
새 채팅을 시작하면 사용 제한이 초기화됩니까?
아닙니다. 사용량은 계정 단위로 계산되므로, 새 채팅을 시작해도 동일한 잔여 허용량 내에서 차감됩니다. 다만 새 대화는 Claude가 다시 읽어야 할 이전 기록이 없으므로 이후 메시지당 비용은 더 저렴해집니다. Claude Code에서 /clear를 실행해도 동일한 효과가 있으며 비용이 발생하지 않지만, /compact은 요약할 대화 내용을 읽어야 하므로 매우 긴 세션을 압축하는 작업 자체가 비용이 발생하는 요청입니다.
API가 플랜을 업그레이드하는 것보다 저렴합니까?
사용량의 일정함에 따라 다릅니다. 이 페이지에서 작업한 오후 시간의 비용은 2026년 8월 정가 기준으로 Sonnet 3.5 모델 사용 시 $2.26, Haiku 3.5 모델 사용 시 $1.13입니다. 구독은 정해진 허용량에 대해 고정 요금을 지불하는 방식이므로, 매일 꾸준히 작업할 때 유리합니다. 토큰당 과금 방식은 사용량이 불규칙할 때 유리한데, 사용하지 않는 날에는 비용이 전혀 발생하지 않기 때문입니다.
제한이 초기화될 때까지 작업을 계속 실행할 수 있습니까?
네, 구독 플랜에서 분리하여 실행하면 가능합니다. VPS에서 환경 변수에 ANTHROPIC_API_KEY를 설정하고 실행하면 플랜의 사용량 제한을 소모하지 않고 토큰당 과금으로 처리되므로, 두 방식이 서로 충돌하지 않습니다. tmux 내부에서 claude --bare -p를 실행하면 노트북을 닫아도 작업이 유지되며, --output-format json은 total_cost_usd 필드를 기록하므로 아침에 jq을 사용하여 확인할 수 있습니다.