Claude API와 구독 서비스 중 무엇이 더 저렴할까?
Claude API 사용량 기반 과금과 월간 구독 요금제의 비용 효율을 비교합니다. 현재 토큰당 요금을 기준으로 손익분기점을 계산하고, 사용 패턴에 따른 실제 비용 차이를 분석하여 본인에게 유리한 선택 기준을 제시합니다.
Claude API가 구독보다 저렴합니까?
Claude API는 특정 사용량 이하에서는 구독보다 저렴하지만, 그 이상에서는 더 비쌉니다. 하루 종일 대화형으로 코딩하는 개발자에게는 일반적으로 정액제 요금제가 유리합니다. 스스로 API 호출을 수행하는 프로그램의 경우 API가 유일한 선택지이므로 비용이 결정 요인이 되지 않습니다. 나머지는 10분이면 계산할 수 있는 산수입니다.
참고할 수 있는 공식적인 손익분기점 수치는 없습니다. 구독 서비스는 토큰 허용량이 아닌 사용량 윈도우(usage windows) 방식으로 판매되므로, 두 비용 곡선이 교차하는 지점을 알려주는 공개된 수치는 없습니다. 아래 내용은 현재 토큰당 요금을 기준으로 한 계산식이며, 요금제 비용보다 결과에 더 큰 영향을 미치는 사용자 본인의 사용 패턴을 포함합니다. 아래의 모든 손익분기점 수치는 공개된 요금과 설정된 가정을 바탕으로 직접 계산한 것이며, 공식적으로 문서화된 수치가 아닙니다.
어떤 요금제를 구매할지 아직 결정하지 못했다면, 본인의 작업 방식에 맞는 Claude 요금제에서 확인하실 수 있습니다. 이 글은 어떤 요금제를 구매할지 이미 알고 있으며, 구독을 하는 것이 맞는지 고민하는 분들을 전제로 작성되었습니다.
서로 다른 형태의 두 가지 과금 모델
구독은 사용하지 않을 수도 있는 용량입니다. 고정 요금을 지불하고 일정 주기로 초기화되는 사용량을 할당받습니다. Anthropic의 Claude Code 문서에 따르면 Team 및 Enterprise 좌석의 형태는 다음과 같습니다. 사용량은 "5시간 단위의 롤링 윈도우와 주간 단위로 초기화되는 좌석별 할당량에서 차감"되며, 이는 Claude 채팅 및 Cowork와 공유됩니다. 구독자는 "세션 제한에 도달했습니다" 및 "주간 제한에 도달했습니다"라는 메시지를 통해 동일한 형태의 제한을 경험합니다. 사용하지 않은 용량은 이미 지불한 비용이 됩니다. 용량을 초과하면 윈도우가 초기화될 때까지 작업이 중단되며, /model로 모델을 전환해도 윈도우가 모델 간에 공유되므로 접근 권한이 복원되지 않습니다. 현재 이러한 메시지를 보고 있다면, 어떤 윈도우를 기다려야 하는지 파악하는 것이 모든 계산보다 우선합니다. 5시간 제한과 주간 제한은 대응 방식이 다르기 때문입니다.
API는 멈추지 않는 계량기입니다. 윈도우나 제한 벽이 없습니다. 모든 요청은 토큰당 가격이 책정되며, 토큰 외의 항목도 가격이 매겨집니다. 예를 들어 웹 검색은 "Claude API에서 1,000회 검색당 10달러"로 이용 가능합니다. 제한으로 인해 중단되는 일은 없습니다. 청구서 금액이 늘어날 뿐입니다. 그 아래에 무료 티어는 없지만, 가입 크레딧과 무료로 제공되는 부분을 활용하면 계산이 중요해지기 전에 첫 번째 실험을 수행할 수 있습니다.
2026년 7월 23일 기준 Claude 가격 페이지에 명시된 플랜 요금은 다음과 같습니다. Pro는 "연간 구독 할인 적용 시 월 17달러(200달러 선결제). 월 단위 결제 시 20달러"이며 Claude Code가 포함됩니다. Max는 "월 100달러부터"로 기재되어 있습니다. Team 좌석은 "연간 결제 시 좌석당 월 20달러"부터 시작합니다. Enterprise는 두 모델을 동시에 운영하므로 흥미로운 사례입니다. "좌석 요금 + API 요금으로 사용량 부과, 좌석당 20달러"로 구성됩니다. 이 하이브리드 모델을 고려 중이라면, Enterprise 좌석 요금의 실제 포함 범위를 통해 좌석 최소 수량과 협의된 견적에서만 제공되는 항목을 확인하십시오. Claude 전체가 아닌 코딩 도구의 가격을 산정하는 경우, 각 플랜별 Claude Code 비용에서 월간 예상 사용량을 기준으로 동일한 요금을 비교할 수 있습니다. 이 비교의 고정 요금 측면에서 아직 Claude를 결정하지 못했다면, ChatGPT의 Go, Plus, Pro 요금제와 비교한 티어가 결정의 나머지 절반이 될 것입니다. 요금은 자주 변경되며 각 요금제 이면의 할당량은 토큰 단위로 공개되지 않으므로, 결정하는 날 가격 페이지를 확인하십시오.
API에서 제공하지 않는 기능
플랜 허용량 및 관련 인터페이스. Claude Code의 /usage-credits 명령어는 구독 사용 크레딧을 관리하며, "/login를 통해 claude.ai 구독으로 로그인한 후에만 실행할 수 있습니다. API 키 인증 방식에서는 이 명령어를 사용할 수 없습니다." /usage 화면 또한 결제 모드에 따라 다릅니다. API 사용자를 위한 세션 블록에는 "API 토큰 사용량이 표시되지만", 구독자는 대신 플랜 사용량 막대와 상세 사용 내역을 확인하게 됩니다.
Claude Code의 더 긴 프롬프트 캐시. 이 기능은 실제 비용이 발생하며 간과하기 쉽습니다. 문서에 따르면 "캐시 유지 시간은 구독 시 1시간이지만, 사용 크레딧을 소진하기 시작하면 5분으로 줄어듭니다. API 키나 클라우드 제공업체를 사용하는 경우 기본값은 5분입니다." 캐시 유지 시간보다 긴 휴식 후 첫 메시지를 보내면 캐시를 사용할 수 없게 되며, 전체 컨텍스트가 다시 처리되어 쓰기 비용이 청구됩니다. 구독 중이라면 50분간 회의를 하고 돌아와도 캐시가 유지되지만, API 키를 사용하면 동일한 휴식 시간에도 세션 접두사를 완전히 다시 작성해야 하므로 비용이 발생합니다.
구독으로 얻을 수 없는 것
프로그래밍 방식의 접근. Claude를 호출하는 cron job이나 webhook 핸들러에는 API key가 필요하므로, 이러한 작업이 주된 목적이라면 비교할 대상이 아닙니다. VPS에서 첫 번째 Claude API 앱 구축하기에서 key 관리 방법과 첫 번째 작동 스크립트를 다룹니다.
Batch API 할인. 가격 페이지에는 "Batch API는 대량의 요청을 비동기적으로 처리하며 입력 및 출력 토큰 모두에 대해 50% 할인을 제공합니다"라고 명시되어 있습니다. 사람이 기다릴 필요가 없는 작업이라면 비용이 절반으로 줄어듭니다. 토큰 100만 개당 Batch 요금은 Opus 4.8의 경우 입력 $2.50, 출력 $12.50이며, Sonnet 5는 도입 가격으로 입력 $1, 출력 $5, Haiku 4.5는 입력 $0.50, 출력 $2.50입니다. 대신 지연 시간이 발생합니다. 대부분의 배치는 1시간 이내에 완료되지만, 24시간 내에 완료되지 않은 배치는 만료되며 스트리밍은 배치 처리가 불가능합니다. 배치와 prompt caching은 중첩하여 사용할 수 있으며, 배치는 5분 이상 실행될 수 있으므로 그 안에서 1시간짜리 캐시를 활용하십시오.
프로젝트별 비용 귀속. 모든 API 응답은 usage 블록을 반환하므로, 단일 요청의 비용을 기록하여 특정 프로젝트나 고객에게 귀속시킬 수 있습니다. 구독은 해당 계정을 보유한 사용자에 대한 통합 비용만 보고합니다.
한 가지 주의할 점은 양방향으로 오해하기 쉽다는 것입니다. 이 둘은 별도의 결제 체계입니다. Anthropic의 문서는 구독 결제는 claude.ai 지원으로, Console 결제는 API 플랫폼으로 안내하며, /usage-credits은 API key 환경에서 작동하지 않습니다. 구독에 API 크레딧이 포함된다는 내용은 어디에도 없으므로, 두 개의 계정과 두 개의 청구서를 계획하십시오.
손익분기점 공식
한 번의 요청에 대한 가격을 산정한 뒤, 이를 확장하여 계산합니다.
turn cost = uncached_input_tokens x base_input_price
+ cache_write_tokens x 1.25 x base_input_price
+ cache_read_tokens x 0.10 x base_input_price
+ output_tokens x output_price
monthly API cost = turn cost x turns_per_active_day x active_days_per_month
break even when: monthly API cost = flat plan fee승수는 추정치가 아닌 공개된 수치를 사용합니다. 5분 캐시 쓰기는 "기본 입력 가격의 1.25배", 1시간 캐시 쓰기는 "기본 입력 가격의 2배", 캐시 읽기는 "기본 입력 가격의 0.1배"로 비용이 책정됩니다. 사고(thinking) 토큰은 출력 토큰으로 청구되므로, 추론 요약이 표시되지 않는 모델이라도 output_tokens에 포함됩니다.
2026년 7월 23일 기준, 백만 토큰(MTok)당 기본 요금은 다음과 같습니다.
claude-fable-5: 입력 $10, 출력 $50. 캐시 읽기 $1. 5분 캐시 쓰기 $12.50. 컨텍스트 1M.claude-opus-4-8및claude-opus-4-7: 입력 $5, 출력 $25. 캐시 읽기 $0.50. 5분 캐시 쓰기 $6.25. 컨텍스트 1M.claude-sonnet-5: 2026년 8월 31일까지 도입 가격으로 입력 $2, 출력 $10, 이후 각각 $3, $15. 도입 가격 기준 캐시 읽기 $0.20, 5분 캐시 쓰기 $2.50. 컨텍스트 1M.claude-haiku-4-5: 입력 $1, 출력 $5. 캐시 읽기 $0.10. 5분 캐시 쓰기 $1.25. 컨텍스트 200K.
긴 컨텍스트에 대한 추가 요금은 없습니다. "900k 토큰 요청은 9k 토큰 요청과 동일한 토큰당 요금으로 청구됩니다."
작업 예시 및 가정 사항
Sonnet 5 모델을 사용하여 60,000 토큰의 컨텍스트를 처리하는 Claude Code 세션의 한 턴을 예로 들어 보겠습니다. 이 중 55,000 토큰은 캐시에서 불러오고, 3,000 토큰은 새로 캐시에 기록하며, 2,000 토큰은 캐시되지 않은 새로운 입력, 1,200 토큰은 사고 과정을 포함한 출력입니다.
- 캐시 읽기: 55,000 x $0.20/MTok = $0.0110
- 캐시 쓰기: 3,000 x $2.50/MTok = $0.0075
- 캐시되지 않은 입력: 2,000 x $2.00/MTok = $0.0040
- 출력: 1,200 x $10.00/MTok = $0.0120
즉, 턴당 약 $0.035가 소요됩니다. 활발하게 사용하는 날에 120턴을 수행한다면 하루에 약 $4.14가 발생합니다. 한 달에 20일간 활발히 사용한다고 가정하면 월간 약 $83이 소요됩니다.
위의 고정 요금과 비교하면 두 가지 사실을 동시에 알 수 있습니다. 이는 Pro 요금의 약 4배에 해당하므로, Pro 요금제가 하루 120회의 Sonnet 턴을 보장한다면 이론상 Pro가 더 저렴합니다. 하지만 이 보장 범위는 공개된 수치만으로는 확인할 수 없습니다. 이에 대한 가장 근접한 답변은 Pro 요금제에 포함된 내용과 제한 사항에 대한 자세한 분석에서 확인할 수 있으며, 더 저렴한 요금제가 무조건 유리하다고 판단하기 전에 읽어볼 가치가 있습니다. 동일한 $83은 기본 Max 요금보다 낮으므로, 이 경우 종량제 방식이 Max보다 저렴합니다. 마지막 문장에서 '기본'이라는 단어가 중요한 이유는 Max 요금제는 두 가지 가격으로 제공되며, 실제로 구매하게 될 두 가지 Max 등급 중 어떤 것인지에 따라 비교 기준이 월 $100씩 달라지기 때문입니다.
이제 가정을 하나씩 변경해 보면서 요금제 비용이 더 이상 결정적인 수치가 아니게 되는 상황을 확인해 보십시오.
손익분기점에 플랜 가격보다 더 큰 영향을 미치는 세 가지 요소
프롬프트 캐싱(Prompt caching). 60,000 토큰 분량의 턴을 캐싱 없이 실행하면 전체 프롬프트가 새로운 입력으로 청구됩니다. 60,000 x $2.00/MTok = $0.12에 출력 비용 $0.012를 더해 턴당 $0.132가 발생합니다. 이는 캐싱된 턴보다 거의 4배 비싼 금액이며, 월 $83의 비용을 약 $317로 증가시킵니다. Anthropic이 공개하는 유일한 손익분기점은 작업 부하에 의존하지 않는 다음 기준입니다. "캐시 적중 시 표준 입력 가격의 10%가 청구됩니다. 즉, 5분 유지 시간(1.25배 쓰기)에서는 캐시를 한 번만 읽어도, 1시간 유지 시간(2배 쓰기)에서는 두 번만 읽어도 캐싱이 이득입니다."
두 가지 실패 모드에서는 사용자에게 알림 없이 캐싱이 비활성화됩니다. 첫 번째는 모델의 최소 캐시 가능 길이보다 짧은 접두사입니다. Fable 5는 512 토큰, Opus 4.8과 Sonnet 5는 1,024 토큰, Opus 4.7은 2,048 토큰, Haiku 4.5는 4,096 토큰이 기준입니다. 접두사가 이보다 짧으면 캐싱되지 않으며 오류도 발생하지 않습니다. 두 번째는 병렬 요청입니다. "캐시 항목은 첫 번째 응답이 시작된 후에만 사용 가능해지기 때문"입니다. 동시에 실행된 10개의 동일한 요청은 모두 전체 입력 가격을 지불합니다. 두 경우 모두 cache_read_input_tokens가 0으로 표시되는 것으로 확인할 수 있습니다.
모델 선택. 동일한 턴을 Opus 4.8로 계산하면 입력 $5, 출력 $25이며, 캐시 읽기는 $0.50, 5분 쓰기는 MTok당 $6.25입니다. 읽기 $0.0275, 쓰기 $0.0188, 캐싱되지 않은 입력 $0.0100, 출력 $0.0300이 발생합니다. 이는 턴당 약 $0.086으로 Sonnet 턴의 2.5배이며, 동일한 작업량일 때 월 약 $207가 됩니다. 모델 선택 하나로 동일한 작업이 최대 요금 미만에서 두 배 이상으로 바뀔 수 있습니다. Haiku 4.5는 입력 $1, 출력 $5로 로그 분류와 같은 기계적 작업에서 비용을 낮춰줍니다. Fable 5는 입력 $10, 출력 $50으로 비용을 더 높이므로, 기본 모델로 설정하기 전에 어떤 작업이 실제로 Fable 5의 비용을 상쇄하는지 읽어보는 것이 좋습니다.
노력 수준(Effort level)은 모델 선택에 포함됩니다. 사고 토큰(thinking tokens)은 출력 요금으로 청구되기 때문입니다. Opus 4.8의 API 기본값은 high이며, 코딩 및 에이전트 작업의 문서화된 시작점은 더 비용이 많이 드는 xhigh입니다. Claude Code에서는 /effort로, API에서는 output_config.effort로 이를 낮출 수 있습니다. 이전 추정치를 바꾸는 또 다른 요소는 최신 모델이 사용하는 새로운 토크나이저입니다. 이 토크나이저는 "동일한 텍스트에 대해 약 30% 더 많은 토큰을 생성"하므로, 구형 모델에서 측정된 토큰 수는 오늘날 동일한 텍스트를 과소평가하게 됩니다.
세션 위생(Session hygiene). API는 상태를 저장하지 않으므로 모든 턴마다 전체 대화 내용을 청구 가능한 입력으로 다시 보냅니다. 따라서 긴 세션은 새로운 세션보다 메시지당 비용이 더 많이 듭니다. 이는 예상치 못한 청구서가 발생하는 주된 원인이며, Claude Code 세션에서 실제로 토큰을 소비하는 요소에서 자세히 다룹니다. 관련 없는 작업 사이에는 /clear를 실행하십시오. 오래된 컨텍스트는 이후 모든 메시지에서 다시 전송되고 다시 청구되기 때문입니다. 긴 작업 내부에서는 /compact을 실행하여 기록을 전체가 아닌 요약본으로 유지하십시오. 작업은 연속적으로 수행하십시오. 기본 캐시는 "5분의 수명"을 가지며 "캐시된 콘텐츠가 사용될 때마다 추가 비용 없이 갱신"되기 때문입니다. 10분마다 한 번씩 세션을 건드리면 매번 다시 쓰기 비용을 지불하게 됩니다. VPS의 tmux에서 실행되는 분리된 Claude Code 세션은 유휴 상태일 때 거의 비용이 들지 않지만, 캐시 수명을 넘겨 유휴 상태가 지속되면 따뜻한 접두사(warm prefix)를 잃게 됩니다.
결정하기 전에 자신의 사용량을 측정하십시오
제 사례를 기준으로 결정하지 마십시오. 본인의 일주일 사용량을 기준으로 결정하십시오.
Claude Code에서 일주일 동안 매 세션이 끝날 때마다 /usage을 실행하십시오(/cost는 동일한 화면을 보여주는 별칭입니다). 이 명령은 해당 세션의 토큰 사용량과 예상 비용을 보고합니다. 단, 문서에 명시된 주의 사항이 있습니다. "달러 수치는 토큰 수를 바탕으로 로컬에서 계산된 추정치이며 실제 청구 금액과는 다를 수 있습니다." /clear을 실행하면 합계가 초기화되므로 실행 전에 화면을 먼저 확인하십시오. 구독 중인 경우 해당 달러 수치는 실제 청구 금액이 아니지만, 그 근거가 되는 토큰 수는 이 공식에 필요한 값입니다. /context는 현재 컨텍스트 윈도우를 채우고 있는 내용을 보여줍니다.
API 계정의 경우 Claude Console의 사용량 페이지가 공식 기록입니다. 프롬프트를 보내기 전에 가격을 책정하려면 client.messages.count_tokens()를 사용하십시오. 이는 "무료로 사용할 수 있으나 사용 등급에 따른 분당 요청 제한이 적용"되며, 실제 청구 시 적용되는 토크나이저를 사용하는 유일한 측정 도구입니다.
호출 후에는 사용량 블록을 읽되, 올바르게 해석해야 합니다.
u = response.usage
total_input = u.input_tokens + u.cache_creation_input_tokens + u.cache_read_input_tokensinput_tokens은 캐시되지 않은 나머지 부분만 계산하며, 문서에서는 이를 "마지막 캐시 중단점 이후의 토큰"으로 정의합니다. input_tokens: 4000이라고 보고된 턴은 4,000토큰짜리 턴이 아닙니다. 세 가지 필드를 모두 더한 값이 이 공식에서 요구하는 프롬프트 크기입니다.
그다음 비교한다. 측정한 월간 사용량이 요금제 비용보다 확실히 낮다면 종량제를 선택한다. 확실히 높다면 해당 요금제의 사용량 한도로 평소 업무일을 감당할 수 있는 경우에 요금제를 선택한다. 경계선에 가까우면 요금제를 선택한다. 요금제는 예상 밖의 비용이 발생하지 않지만 종량제는 그럴 수 있기 때문이다. 사용량이 Pro 요금제 비용보다도 크게 낮다면 어느 쪽을 구매하기 전에 자신의 작업 방식에서 유료 요금제가 무료 등급보다 나은지 판단한다. 사용량이 이 정도로 적으면 무료 한도에 자주 도달하지 않아 요금제를 전혀 구매할 필요가 없을 수 있기 때문이다. 또한 어느 선택도 되돌릴 수 없는 것은 아니다. 몇 주 더 실제 사용량을 확인한 결과 예상과 다르더라도 요금제를 취소하거나 등급을 낮추면 이미 결제한 기간은 그대로 유지된다. 어느 쪽을 선택하든 이 계산으로는 어떤 과금 모델이 더 저렴한지만 결정할 수 있다. 절약한 시간으로 지출을 회수할 수 있는지는 자신의 시간당 요금을 기준으로 별도로 계산해야 한다.
FAQ
Claude API가 Claude Pro나 Max보다 저렴합니까?
사용량에 따라 다르며, 구독은 토큰 할당량이 아닌 사용 기간 단위로 판매되므로 참고할 수 있는 공식적인 손익분기점은 없습니다. 공개된 토큰당 요금을 기준으로 일반적인 대화 한 번의 비용을 산출한 뒤, 월간 활성 일수와 일일 대화 횟수를 곱하여 구독료와 비교하십시오. 예를 들어 60,000 토큰을 사용하는 Sonnet 5 대화 한 번의 비용은 약 $0.035입니다. 이를 20일 동안 하루 120회 대화한다고 가정하면 월 $83 정도가 되는데, 이는 Pro 요금보다는 높고 기본 Max 요금보다는 낮은 수준입니다.
Claude API의 월간 비용은 어떻게 계산합니까?
실제 토큰 사용량을 수집하려면 일주일 동안 Claude Code에서 /usage을 실행하거나, 이미 API 계정이 있다면 Claude Console의 사용량 페이지를 확인하십시오. 그런 다음 대화 한 번의 비용을 계산합니다. 캐시되지 않은 입력은 기본 요율, 캐시 쓰기는 기본 입력 요율의 1.25배, 캐시 읽기는 기본 입력 요율의 0.1배, 출력은 출력 요율을 적용하며, 사고(thinking) 토큰은 출력 토큰으로 간주합니다. 이 값을 일일 대화 횟수와 월간 활성 일수에 곱하십시오.
Claude API 청구 금액에 가장 큰 영향을 주는 요소는 무엇입니까?
무엇보다 프롬프트 캐싱이 가장 큰 영향을 미칩니다. Sonnet 5에서 60,000 토큰을 사용하는 대화의 경우, 접두사가 캐시에서 제공되면 약 $0.035가 들지만 그렇지 않으면 약 $0.132가 듭니다. 그다음은 모델 선택입니다. Opus 4.8에서 동일한 대화를 수행하면 약 $0.086이 듭니다. 세 번째는 세션 길이입니다. API는 상태를 유지하지 않으므로 매 대화마다 전체 대화 내용을 입력으로 다시 전송하여 요금이 부과되기 때문입니다.
Claude 구독에 API 액세스가 포함됩니까?
두 서비스는 별도의 계정과 청구서로 관리됩니다. API 호출은 Console에서 생성한 계정을 통해 토큰 단위로 과금되며, 확인된 문서상 구독이 API 크레딧을 제공한다는 내용은 없습니다. 두 서비스가 별개라는 가장 명확한 증거는 Claude Code의 /usage-credits 명령입니다. 이 명령은 "API 키 인증으로는 사용할 수 없습니다". 많은 개발자가 대화형 코딩을 위한 구독과 직접 구축하는 서비스를 위한 API 키를 모두 보유하고 있습니다.