SSD Nodes Learn Hosting plans →
가이드 Matt Connor작성자 Matt Connor · 업데이트됨 2026-09-22

Claude 사용량 제한 해결 방법 및 초기화 시간 확인

Claude 사용량 제한 메시지가 발생했을 때 세션 및 주간 초기화 시간을 확인하는 방법을 안내합니다. 설정 메뉴나 claude usage 명령어를 통해 남은 할당량을 파악하고, 모델 변경이나 API 활용 등 상황에 맞는 대처 전략을 선택하십시오.

어떤 Claude 제한에 도달했는지 확인하기

Claude 제한 도달 메시지는 대기해야 하는 시간대를 명시하며, 해당 시간대에 따라 다음 작업을 결정할 수 있습니다. 세션 제한과 주간 제한은 모든 모델에 동시에 적용되므로, 모델을 변경해도 사용 권한이 복구되지 않습니다. 특정 모델을 명시하는 제한은 예외입니다. 이 경우 모델을 변경하면 해당 모델이 차단된 상태에서도 계속 작업할 수 있습니다.

Claude Code는 제한 시간대와 초기화 시간을 같은 줄에 출력합니다.

You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm

세션 시간대는 5시간 단위로 갱신되는 롤링 방식입니다. 주간 시간대는 계정에 할당된 매주 고정된 시간에 초기화되므로, 요일과 시간은 매주 동일하게 유지됩니다. Pro 플랜은 5시간 세션 시간대와 모든 모델에 적용되는 주간 제한 1개를 포함합니다. Max 플랜은 특정 모델 제품군에만 적용되는 두 번째 주간 제한을 추가로 제공합니다. 제한 수치 자체는 Claude 사용 제한 상세 내역에서 확인할 수 있습니다. 이 페이지는 해당 문서가 끝나는 지점부터 시작합니다.

사용자들이 자주 혼동하는 부분은 다음과 같습니다. 모든 요청은 세션 시간대와 주간 시간대에 동시에 반영됩니다. 따라서 오후에 집중적으로 사용하면 5시간 세션 시간대에는 여유가 있더라도 주간 할당량을 모두 소진할 수 있습니다. 남은 하루를 계획하기 전에 초기화 시간을 확인하십시오. 오후 3시 45분에 초기화된다면 커피 한 잔 마시며 쉴 수 있는 시간이지만, 월요일 자정에 초기화된다면 그렇지 않습니다.

추측하기 전에 사용량을 확인하십시오

claude.ai에서 Settings를 연 다음 Usage를 선택하십시오. 진행률 표시줄을 통해 5시간 세션 창과 주간 창의 사용량을 확인할 수 있으므로, 무엇이 소진되었는지 추측할 필요 없이 바로 알 수 있습니다.

Claude Code에서는 /usage을 실행하십시오. 이 명령은 동일한 계획 표시줄과 함께 최근 사용량이 어디에 소비되었는지에 대한 분석을 제공하며, 기술, 하위 에이전트, 플러그인 및 개별 MCP(model context protocol) 서버별로 전체 대비 비율을 보여줍니다. 최근 24시간 사용량은 d를, 최근 7일 사용량은 w을 눌러 확인하십시오. 또한 최근 사용량의 10% 이상을 차지하는 패턴을 표시하며, 가장 흔히 나타나는 두 가지는 긴 컨텍스트와 캐시 미스입니다.

두 가지 주의 사항이 있습니다. 사용량 분석은 해당 기기에 저장된 세션 기록을 기반으로 계산되므로, 다른 노트북이나 claude.ai에서 수행한 작업은 동일한 할당량을 사용했더라도 분석에 포함되지 않습니다. 이는 Claude Code와 claude.ai 채팅은 하나의 구독 창을 공유하기 때문입니다. 또한 상단 Session 블록에 표시되는 달러 금액은 API(application programming interface) 사용자를 위한 표준 정가 기준이므로, 구독 중인 경우 실제 청구 금액과는 다릅니다.

더 작은 모델로 전환하면 도움이 됩니까?

메시지에서 모델을 지정할 때만 도움이 됩니다. You've hit your Opus limit 이후에 /model를 실행하고 Sonnet이나 Haiku를 선택하면, 세션이 모든 컨텍스트를 유지한 채 계속됩니다. You've hit your session limit 또는 You've hit your weekly limit 이후에는 /model를 수행해도 아무것도 바뀌지 않습니다. 해당 창들은 모든 모델 간에 공유되기 때문입니다.

모델 전환은 한계에 도달한 뒤보다 도달하기 전에 하는 것이 훨씬 가치가 있습니다. Sonnet은 대부분의 코딩 작업을 Opus 비용의 일부만으로 처리하므로, Opus를 기본값으로 유지하는 것은 예상치 못한 사용량 증가를 유발하는 두 가지 습관 중 하나입니다. 다른 하나는 세션을 절대 비우지 않는 것입니다. 기계적인 편집이나 로그 분류는 Haiku에 맡기고, 진정으로 막혀 있는 설계 결정에만 Opus를 사용하십시오. Opus, Sonnet, Haiku 선택하기에서 각 모델이 비용에 상응하는 가치를 발휘하는 상황을 다룹니다.

사용하지 않는 컨텍스트에 대한 비용 지불 중단

Claude Code는 요청을 보낼 때마다 전체 대화 내용을 함께 전송하며, Claude가 도구를 사용할 때마다 해당 도구 결과물을 포함한 새로운 요청을 보냅니다. 프롬프트 캐싱(prompt caching)을 사용하면 전체 입력 요금이 아닌 캐시 요금으로 기록을 다시 읽어오므로 비용이 저렴해지지만, 무료는 아닙니다. 따라서 아침부터 열어둔 세션에서 한 줄짜리 질문을 하더라도 전체 대화 내용에 대한 사용량이 발생합니다.

/context
/clear
/compact Focus on the failing tests and the files we changed

/clear은 컨텍스트를 읽지 않고 폐기하므로 비용이 발생하지 않습니다. /compact은 요약할 대화 내용을 읽어야 하므로, 매우 큰 컨텍스트를 압축하는 작업 자체가 큰 요청이 됩니다. 관련 없는 작업으로 넘어갈 때는 /clear을 사용하고, 작업 도중에 스레드를 유지해야 할 때만 /compact를 사용하십시오. 세션을 정리하기 전에 /rename을 실행하면 나중에 /resume을 통해 해당 세션을 다시 찾을 수 있습니다.

캐시 유지 시간은 생각보다 중요합니다. 구독 중에는 캐시가 1시간 동안 유지됩니다. 사용량 크레딧을 소진하기 시작하면 5분으로 단축되며, API 키 사용 시에도 기본값은 5분입니다. 긴 점심시간 이후 첫 메시지를 보내면 캐시를 놓치고 전체 컨텍스트를 다시 처리하게 되어 전체 입력 비용이 발생합니다. 이것이 특별한 이유 없이 사용량이 급증하는 원인입니다. 프롬프트 캐싱이 비용 효율적인 경우에서 관련 계산 방식을 다룹니다.

같은 위치에 세 가지 추가 조절 장치가 있습니다. /mcp는 구성된 서버 목록을 보여주므로 현재 작업에 필요하지 않은 서버를 끌 수 있습니다. 긴 CLAUDE.md는 작업 필요 여부와 관계없이 세션 시작 시 로드되므로, 호출될 때만 로드되는 기술(skills)로 특수 지침을 옮기십시오. 확장된 사고(extended thinking)는 비용이 많이 드는 출력 토큰으로 청구되므로, /effort으로 낮추거나, /config에서 끄거나, 고정된 사고 예산이 설정된 모델에서 MAX_THINKING_TOKENS=8000를 설정하십시오.

작업을 분할하여 단일 창에 맞추기

대규모 변경을 수행하기 전 Shift+Tab을 눌러 계획 모드로 전환하십시오. Claude가 코드베이스를 탐색하고 접근 방식을 제안하면 이를 승인하십시오. 잘못된 방향을 계획 단계에서 발견하면 계획 하나를 소모하는 것으로 끝나지만, 이를 놓치면 2시간의 편집 작업과 재작업이 발생합니다.

번거로운 작업은 하위 에이전트에게 위임하십시오. 테스트 스위트를 실행하거나 10,000줄에 달하는 로그를 읽는 작업을 하위 에이전트 내부에서 수행하면 원시 출력은 해당 에이전트의 컨텍스트에 남고, 요약된 결과만 메인 대화창으로 돌아옵니다.

Claude가 잘못된 방향으로 진행하는 즉시 Escape를 누르십시오. /rewind은 대화와 코드를 이전 체크포인트로 복원하므로, 원치 않는 작업을 되돌리기 위해 비용을 지불할 필요가 없습니다.

사용량 크레딧을 구매해야 합니까, 아니면 API를 사용해야 합니까?

사용량 크레딧을 사용하면 Pro 또는 Max 계정이 플랜 허용량을 초과하더라도 표준 API 요율로 청구되어 서비스를 계속 이용할 수 있습니다. 결제 수단이 등록된 상태에서 claude.ai의 Settings 메뉴 내 Usage 항목으로 이동하여 크레딧을 활성화하거나, Claude Code에서 /usage-credits 명령어를 실행하여 브라우저에서 결제 설정을 열 수 있습니다. 크레딧은 Claude 대화와 Claude Code 터미널 사용량 모두에 적용되며, 일일 사용 한도는 2000달러입니다. 이 명령어는 구독 로그인이 필요하므로 API 키로 인증하는 경우에는 사용할 수 없습니다. 무료 플랜에서는 크레딧이 제공되지 않으므로, 우선 월 20달러의 Pro 플랜으로 전환해야 합니다. Pro 플랜의 추가 기능 및 제한 사항에서 상세 내용을 확인할 수 있습니다. 매주 크레딧을 충전하고 있다면 더 높은 플랜으로 변경하는 것이 일반적으로 비용 면에서 유리하며, 100달러 Max 티어와 200달러 Max 티어의 차이는 모델이나 기능의 차이가 아니라 사용량 배수의 차이입니다.

다른 방법은 Claude Console에서 발급받은 일반 API 키를 사용하는 것으로, 세션이나 주간 제한 없이 토큰 단위로 요금이 청구됩니다. 주의할 점은 환경 변수에 ANTHROPIC_API_KEY이 설정되어 있으면 Claude Code가 구독 계정이 아닌 해당 API 키를 통해 실행된다는 것입니다. 이 사실은 청구서를 확인하거나 다음 메시지를 통해 알 수 있습니다.

API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.

여기서 발생하는 429 오류는 플랜의 제한이 아니라 API 키의 속도 제한(rate limit)입니다. /status 명령어를 실행하여 현재 활성화된 자격 증명이 의도한 것인지 확인하십시오.

API 사용 시 오후 한나절 비용은 얼마인가?

아래의 작업 예시는 에이전트 스타일 코딩으로 보낸 오후 한나절의 사례입니다. 캐시되지 않은 입력 토큰 200,000개, 캐시 읽기 180만 개, 출력 토큰 150,000개를 사용했습니다. 가격은 2026년 8월 기준 Anthropic의 정가표를 따릅니다. 모든 요금은 100만 토큰당 가격으로 책정되므로, 이 단위가 추상적으로 느껴진다면 100만 토큰의 실제 가치를 통해 읽고 쓰는 분량을 가늠해 볼 수 있습니다.

ChartOne afternoon of agent work priced at API list rates, August 2026
The data behind this chart
[
  {
    "label": "Opus 5",
    "input_usd_per_mtok": 5,
    "cache_read_usd_per_mtok": 0.5,
    "output_usd_per_mtok": 25,
    "afternoon_usd": 5.65
  },
  {
    "label": "Sonnet 5",
    "input_usd_per_mtok": 2,
    "cache_read_usd_per_mtok": 0.2,
    "output_usd_per_mtok": 10,
    "afternoon_usd": 2.26
  },
  {
    "label": "Haiku 4.5",
    "input_usd_per_mtok": 1,
    "cache_read_usd_per_mtok": 0.1,
    "output_usd_per_mtok": 5,
    "afternoon_usd": 1.13
  }
]

같은 오후 작업에 대해 Opus 5는 $5.65, Haiku 4.5는 $1.13의 비용이 발생합니다. 전체 비용을 결정짓는 핵심은 출력 토큰입니다. Opus 5의 100만 토큰당 출력 비용은 $25인 반면 Haiku 4.5는 $5입니다. Claude가 작성하는 150,000개의 토큰이 읽어 들이는 200만 개의 토큰보다 더 많은 비용을 차지합니다. 이것이 파일 크기를 줄이는 것보다 사고(thinking) 예산을 낮추는 것이 비용 절감에 더 효과적인 이유입니다. 어떤 모델을 실행할지보다 어떤 제공업체를 선택할지가 고민이라면, Claude와 ChatGPT API에서 세 가지 작업을 수행했을 때의 비용 비교를 통해 각 서비스의 비용 효율성을 확인할 수 있습니다.

참고할 날짜가 하나 있습니다. Sonnet 5는 2026년 8월 31일까지 100만 입력/출력 토큰당 각각 $2와 $10의 도입 가격이 적용됩니다. 2026년 9월 1일부터는 각각 $3와 $15로 인상되며, 이에 따라 동일한 오후 작업 비용은 $2.26에서 약 $3.39로 상승합니다.

오후 작업 비용 산출 방식

Opus 5: 캐시되지 않은 입력 토큰 200,000개(100만 토큰당 $5)는 $1.00입니다. 입력 요금의 1/10인 캐시 읽기 180만 개는 $0.90입니다. 출력 토큰 150,000개(100만 토큰당 $25)는 $3.75입니다. 합계 $5.65.

Sonnet 5: 캐시되지 않은 입력 $0.40, 캐시 읽기 $0.36, 출력 $1.50. 합계 $2.26.

Haiku 4.5: 캐시되지 않은 입력 $0.20, 캐시 읽기 $0.18, 출력 $0.75. 합계 $1.13.

모든 3개 행은 동일한 토큰 수를 가정하므로, 차액은 순수하게 가격 차이에서 발생합니다. 실제 오후 작업 비용은 컨텍스트가 얼마나 캐시 상태로 유지되느냐에 따라 달라집니다.

규모를 가늠하기 위해 Anthropic의 자체 문서에 따르면, 2026년 8월 기준 기업 환경에서 Claude Code를 사용하는 개발자의 일일 평균 비용은 약 $13이며, 사용자의 90%는 활성 일수당 $30 미만을 지출합니다. 토큰 단위 과금이 구독 모델보다 항상 저렴한 것은 아닙니다. 작업량이 불규칙할 때는 사용하지 않는 날 비용이 발생하지 않으므로 유리하지만, 매일 작업하는 경우에는 불리할 수 있습니다. API와 구독 모델의 실제 수치 비교에서 손익분기점을 확인할 수 있습니다.

VPS에서 야간에 긴 작업 실행하기

대규모 리팩토링, 테스트 마이그레이션, 문서 정리와 같은 작업은 사용자가 직접 지켜볼 필요가 없습니다. 이러한 작업은 구독 중인 사용자의 대화창을 차지할 필요도 없습니다. API 키를 사용하여 VPS(가상 사설 서버)에서 실행하면 토큰당 비용이 청구되므로, 다음 날 대화형 작업을 위해 할당된 플랜 사용량을 그대로 유지할 수 있습니다.

Ubuntu 서버에 Claude Code를 설치하고 실행되는지 확인합니다.

curl -fsSL https://claude.ai/install.sh | bash
claude --version

claude --version 명령은 2.1.211 (Claude Code)과 같은 버전 문자열을 출력해야 합니다. 여기서 command not found가 발생한다면 ~/.local/bin이 아직 PATH에 추가되지 않은 것이므로, 새 셸을 열고 다시 시도하십시오. 이 설치 프로그램은 Linux 데스크톱에서 실행하는 것과 동일하며, CLI는 베타 데스크톱 앱 및 에디터 플러그인과 함께 설치됩니다.

API 키는 셸 기록에 남기지 말고 파일에 저장하십시오. 에디터로 ~/.claude-env 파일을 생성하여 export ANTHROPIC_API_KEY=sk-ant-your-key-here라는 한 줄을 입력한 뒤, 권한을 제한하고 로드합니다.

chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10

마지막 줄은 키의 처음 10자만 출력합니다. 전체 키를 화면에 노출하지 않고도 변수가 설정되었는지 확인하기에 충분합니다.

이제 노트북 연결을 끊어도 작업이 유지되도록 tmux 안에서 작업을 시작합니다.

tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
  --allowedTools "Read,Edit,Bash" \
  --append-system-prompt-file ./CLAUDE.md \
  --output-format json > ~/overnight.json

Ctrl-b를 누른 뒤 d를 눌러 세션에서 분리하고 연결을 종료합니다. 나중에 tmux attach -t overnight으로 다시 접속할 수 있습니다. VPS의 tmux 세션에서 Claude Code 실행하기에서 세션 관리에 대해 자세히 다룹니다.

여기서는 --bare 옵션이 중요합니다. 이 옵션은 훅, 스킬, 플러그인, CLAUDE.md의 자동 탐색을 건너뛰며 OAuth 자격 증명을 읽지 않으므로, 오직 API 키만 사용하여 실행됩니다. 이것이 작업을 구독 플랜에서 분리하는 방법입니다. 또한 프로젝트 규칙이 적용되지 않으므로 --append-system-prompt-file을 사용하여 명시적으로 규칙을 다시 전달해야 합니다. --bare가 없으면 ANTHROPIC_API_KEY이 설정된 경우 무인 실행 시 답변할 수 없는 일회성 승인 프롬프트가 나타납니다.

아침에 JSON 결과와 비용을 확인합니다.

jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.json

Claude Code는 성공 시 0을, 실패 시 0이 아닌 값을 반환하며 종료합니다. 따라서 래퍼 스크립트를 작성하여 종료 상태에 따라 분기하고 실패 시 메일을 보내도록 설정할 수 있습니다. 작업을 실행하기 전에 Claude Console에서 작업 공간 지출 한도를 설정하십시오. 새벽 3시에 재시도 루프에 빠진 에이전트는 실제 비용을 발생시킬 수 있습니다. 작업 속도를 늦추려면 CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY 값을 낮추십시오. 실행 중인 에이전트의 비용 제어에서 설정해야 할 필수 제한 사항을 다룹니다.

작업을 위해 권한이 없는 별도의 사용자를 생성하고 전용 git 브랜치를 사용하십시오. 무인 상태로 저장소를 수정하는 에이전트는 가끔 사용자가 중단했을 법한 작업을 수행할 수 있습니다. 전용 브랜치를 사용하면 이를 사고가 아닌 git checkout로 처리할 수 있습니다. 코딩 에이전트를 VPS에서 안전하게 실행하기에서 격리 방법을 다룹니다.

수천 개의 레코드를 분류하는 것과 같이 대화형 작업이 전혀 필요 없는 대량 작업의 경우, Batch API를 사용하면 요청을 비동기적으로 처리하며 입력 및 출력 토큰에 대해 50% 할인을 받을 수 있습니다. 이는 Anthropic에서 제공하는 가장 저렴한 토큰당 처리 방식이며, 야간 시간대는 이 방식이 요구하는 지연 시간에 정확히 부합합니다.

접근 권한이 복구되지 않는 경우

사용량 한도는 시간이 지나야만 복구되므로, Claude 사용량 한도를 초기화한다는 모든 방법은 자세히 살펴보면 성립하지 않는다.

새로운 대화를 시작한다고 해서 사용 한도가 복구되지는 않습니다. 사용량은 대화 단위가 아니라 계정 단위로 계산됩니다. 다만, 새로운 대화는 이전 기록을 다시 읽을 필요가 없으므로 이어지는 모든 메시지의 비용이 절감됩니다. 따라서 새 대화를 시작하는 것은 여전히 유효한 방법입니다. 이는 비용 절감일 뿐, 한도 초기화가 아닙니다.

오래된 대화를 삭제해도 환불되는 것은 없습니다. 해당 토큰은 처리되는 시점에 이미 소모되었습니다.

세션이나 주간 메시지 제한 이후 모델을 변경해도 아무런 효과가 없습니다. 해당 제한은 모든 모델에 공통으로 적용되기 때문입니다. 모델을 명시하는 메시지만이 /model에 응답합니다.

반복적으로 재시도하는 것은 터미널을 점유하는 것 외에 아무런 효과가 없습니다. 메시지에 표시된 초기화 시간이 실제 정답이며, /usage를 실행하면 오류 메시지 없이 동일한 타이머를 확인할 수 있습니다.

업그레이드는 한도를 실제로 높이는 유일한 조치이므로, 비용을 지불한 뒤에도 한도가 그대로라면 새 요금제로 변경해도 기존 한도가 유지될 수 있는 이유를 확인한 후 사용량 한도에 문제가 있다고 판단해야 한다.

FAQ

Claude 사용량 제한은 언제 초기화됩니까?

메시지에 초기화 시각이 표시됩니다. 세션 제한은 5시간 단위로 갱신되며, 메시지에 resets 3:45pm와 같은 시각이 나타납니다. 주간 제한은 계정별로 할당된 특정 요일에 초기화되며, 메시지에 resets Mon 12:00am과 같은 요일이 표시됩니다. 제한에 도달하기 전에 두 가지 막대와 초기화 시각을 모두 확인하려면 Claude Code에서 /usage을 실행하거나, claude.ai의 Settings에서 Usage를 확인하십시오.

Sonnet으로 모델을 변경하면 다시 사용할 수 있습니까?

메시지에 특정 모델이 언급된 경우에만 해당합니다. You've hit your Opus limit 이후에는 /model를 실행하여 다른 모델을 선택하면 컨텍스트를 유지한 채 세션을 계속할 수 있습니다. You've hit your session limit 또는 You've hit your weekly limit 이후에는 모델을 변경해도 소용이 없습니다. 해당 제한은 모든 모델의 사용량을 합산하여 계산하기 때문입니다. 제한에 도달하기 전에 더 저렴한 모델로 변경하는 것이 실제 사용 가능 범위를 넓히는 방법입니다.

새 채팅을 시작하면 사용량 제한이 초기화됩니까?

아니요. 사용량은 계정 단위로 계산되므로, 새 채팅을 시작해도 동일한 제한이 적용됩니다. 다만 새 대화는 Claude가 다시 읽어야 할 이전 기록이 없으므로 메시지당 비용이 절감됩니다. Claude Code에서 /clear를 실행해도 같은 효과를 얻을 수 있으며 비용이 발생하지 않습니다. 반면 /compact은 요약할 대화 내용을 읽어야 하므로, 매우 긴 세션을 압축하는 작업 자체는 비용이 발생합니다.

API를 사용하는 것이 플랜을 업그레이드하는 것보다 저렴합니까?

사용량의 일정함에 따라 다릅니다. 2026년 8월 정가 기준으로, 이 페이지에서 작업한 오후 시간의 비용은 Sonnet 3.5 모델 사용 시 $2.26, Haiku 3.5 모델 사용 시 $1.13입니다. 구독은 정해진 한도 내에서 고정 요금을 지불하므로 매일 꾸준히 작업할 때 유리합니다. 사용량이 불규칙할 때는 토큰당 과금 방식이 유리한데, 사용하지 않는 날에는 비용이 전혀 발생하지 않기 때문입니다.

제한이 초기화될 때까지 작업을 계속 실행할 수 있습니까?

네, 구독 플랜에서 분리하면 가능합니다. VPS에서 환경 변수에 ANTHROPIC_API_KEY를 설정하고 실행하면 플랜의 제한을 소모하는 대신 토큰당 요금이 청구되므로, 두 방식이 서로 충돌하지 않습니다. tmux 내에서 claude --bare -p를 사용하면 노트북을 닫아도 작업이 유지되며, --output-format json은 total_cost_usd 필드를 기록하므로 아침에 jq로 확인할 수 있습니다.