SSD Nodes Learn 🎉 VPS $4.99/월부터
가이드 Matt Connor작성자 Matt Connor · 업데이트됨 2026-08-13

Claude Fable 5 API 가격 및 비용 계산 가이드

Claude Fable 5는 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러입니다. 모델별 요금 비교와 프롬프트 캐싱을 활용하여 실제 API 사용 시 발생하는 비용을 최적화하는 방법을 상세히 설명합니다.

Claude Fable 5의 비용은 얼마입니까?

Claude API에서 Claude Fable 5의 비용은 입력 토큰 100만 개당 $10, 출력 토큰 100만 개당 $50입니다. 이는 2026년 8월 3일 기준 Anthropic의 공식 가격 페이지에 게시된 요금입니다. API 모델 ID는 claude-fable-5입니다. 이 모델은 2026년 6월 9일부터 Claude API, Amazon Bedrock, AWS의 Claude Platform, Google Cloud 및 Microsoft Foundry에서 정식으로 제공되었습니다.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

이 가격 체계를 단계별로 이해하십시오. Fable 5의 가격은 Claude Opus 5의 2배, 현재 Claude Sonnet 5 요금의 5배, Claude Haiku 4.5의 10배입니다. 모든 모델의 출력 토큰 가격이 입력 토큰 가격의 정확히 5배로 책정되어 있으므로, 청구서의 양쪽 항목에서 동일한 비율이 적용됩니다. 따라서 작업에 필요한 입력 및 출력 토큰의 비율을 알고 있다면, 곱셈을 통해 한 모델의 가격을 다른 모델의 가격으로 환산할 수 있습니다.

특정 날짜에 따라 계산 방식이 변경됩니다. Sonnet 5는 2026년 8월 31일까지 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10의 도입 할인가가 적용됩니다. 2026년 9월 1일부터는 입력 토큰 100만 개당 $3, 출력 토큰 100만 개당 $15로 요금이 변경됩니다. Fable 5의 가격은 변동이 없으므로, 해당 날짜부터 두 모델 간의 가격 차이는 5배에서 3배 조금 넘는 수준으로 좁혀집니다. 가을철 예산을 수립 중이라면 이후에 적용될 Sonnet의 요금을 사용하십시오.

할인 정책과 비용을 증가시키는 유일한 배율

프롬프트 캐싱은 비용을 절감하는 가장 큰 수단입니다. 캐시 읽기 비용은 기본 입력 가격의 10분의 1이며, Fable 5 기준 토큰 100만 개당 $1입니다. 캐시에 쓰는 비용은 일반 입력 토큰보다 비쌉니다. 5분 캐시는 기본 가격의 1.25배, 1시간 캐시는 2배입니다. 5분 캐시는 한 번만 읽어도 비용을 회수하며, 1시간 캐시는 두 번 읽으면 비용을 회수합니다. 이러한 계산 방식이 모든 곳에 캐싱을 적용하기 전에 프롬프트 캐싱의 손익분기점 계산을 권장하는 이유입니다.

Batch API는 양쪽 모두 50% 할인을 적용하므로, 배치 처리된 Fable 5 작업 비용은 토큰 100만 개당 $5$25입니다. 배치 요청은 비동기식으로 처리되므로 즉각적인 응답이 필요하지 않은 작업에만 유용합니다. 두 할인은 중복 적용되므로, 캐싱과 배치를 동시에 사용하면 두 축 모두에서 비용이 저렴해집니다.

1M 토큰 컨텍스트 윈도우는 Claude 4.6 이후 모델에서 표준 요금으로 제공됩니다. 긴 컨텍스트에 대한 추가 요금은 없으므로, 900k 토큰 요청도 9k 요청과 동일한 토큰당 요금이 청구됩니다.

청구 금액을 높이는 배율은 데이터 상주 정책입니다. inference_geo: "us"를 설정하여 추론을 미국 내로 제한하면 캐시 읽기 및 쓰기를 포함한 모든 토큰 범주에 1.1배의 배율이 적용됩니다. 계약상 의무가 없다면 기본값인 글로벌 라우팅을 그대로 유지하십시오.

이 모델에는 특정한 청구 규칙이 하나 있습니다. Fable 5는 요청을 거부할 수 있는 안전 분류기를 탑재하고 있습니다. 이 경우 Messages API는 오류 대신 stop_reason: "refusal"를 포함한 성공적인 HTTP 200 응답을 반환하며, 출력 생성 전 거부된 요청에 대해서는 요금이 청구되지 않습니다. 동일한 프롬프트를 다른 Claude 모델에서 재시도할 경우, 폴백 크레딧이 전환에 따른 프롬프트 캐시 비용을 환불해주므로 동일한 캐시를 다시 예열하는 비용을 지불할 필요가 없습니다.

어떤 플랜에 Claude Fable 5가 포함되어 있습니까?

2026년 8월 3일 기준으로, Anthropic의 Claude Fable 페이지에 따르면 해당 모델은 Pro, Max, Team 및 Enterprise 사용자에게 제공됩니다. 무료 플랜은 명시되지 않았습니다. Pro는 해당 목록에서 가장 저렴한 요금제이므로, Pro 요금과 사용량 제한이 적용되는 지점이 Fable을 구독하기 위한 최소 비용 기준이 됩니다. 개발자의 경우 Claude API와 위에서 언급한 클라우드 마켓플레이스를 통해 일반적으로 사용할 수 있습니다. 해당 경로에는 무료 티어가 없으므로, 가입 시 Anthropic이 제공하는 소액 크레딧이 과금이 시작되기 전까지 사용할 수 있는 전부입니다.

플랜에서 사용할 수 있다는 것이 제한 없이 포함되어 있다는 의미는 아닙니다. Anthropic 가격 페이지의 플랜 비교표는 일부 좌석의 주간 사용량 제한 공유와 다른 좌석의 사용량 크레딧을 통해 Fable 사용을 제한하고 있으며, 이러한 방식은 2026년 7월 중에 여러 번 변경되었습니다. Fable 5 재배포에 관한 Anthropic의 자체 성명에 따르면, 2026년 7월 7일까지 Pro, Max, Team 및 일부 Enterprise 플랜에서 주간 사용량 제한의 최대 50%까지 모델을 사용할 수 있었으며, 그 이후에는 사용량 크레딧이 적용되었습니다. 7월 나머지 기간 동안의 보고는 추가적인 연장과 좌석 유형별 차등 적용을 설명했습니다.

따라서 이 페이지에는 플랜별 제한 수치를 명시하지 않습니다. 해당 월에 발표된 수치 중 2주 이상 유지된 것은 없었으며, 이곳에 오래된 수치를 기재하는 것은 아예 없는 것보다 못합니다. 결정을 내리는 당일에 플랜 비교표에서 Fable 항목을 확인하고, 뉴스 기사에 나오는 숫자는 모두 구식이라고 간주하십시오. Fable 액세스를 위해 좌석을 구매했으나 허용량이 표에서 예상했던 것보다 적다면, 다음 갱신 전에 등급을 낮추어 이미 결제한 한 달은 그대로 유지할 수 있습니다.

안정적인 것은 API 요금입니다. 모든 경로에서 포함된 허용량을 모두 사용하면, 이후의 Fable 5 사용량은 위 차트의 가격에 따라 청구됩니다. Enterprise는 이러한 구조를 명확히 합니다. Enterprise 좌석 요금은 액세스 권한을 구매하는 것이며, 토큰 자체는 여전히 API 요금으로 측정되기 때문입니다. 결과적으로 어떤 방식이든 가격표를 기준으로 계획을 세워야 하며, 이는 다른 Claude 모델의 API 과금과 구독을 비교할 때 도달하게 되는 결론과 같습니다. 아직 티어를 선택하지 않았다면 사용량에 맞는 Claude 플랜부터 확인하십시오. 해당 좌석을 Fable 접속 용도뿐만 아니라 일상적인 비서로도 사용할 계획이라면, 구독을 결정하기 전에 Claude 플랜과 ChatGPT의 가격을 비교해 보는 것이 좋습니다.

청구 금액이 가격 비율보다 높게 나오는 이유

Fable 5의 비용이 단순 가격 비교보다 높게 책정되는 데에는 두 가지 문서화된 메커니즘이 있습니다.

첫 번째는 토크나이저입니다. Fable 5는 Claude Opus 4.7과 함께 도입된 토크나이저를 사용합니다. Opus 4.7 이전에 출시된 모델과 비교하면 동일한 텍스트라도 약 30% 더 많은 토큰이 생성되며, 정확한 증가량은 콘텐츠에 따라 다릅니다. Haiku 4.5는 해당 토크나이저 이전 모델이므로, 가격표상의 10배 차이는 동일한 텍스트 블록을 입력할 경우 실제로는 13배에 가깝게 벌어집니다. Sonnet 5는 최신 토크나이저를 사용하므로 Fable과 Sonnet 간의 토큰당 비교는 공정하지만, Fable과 Haiku를 비교하는 것은 그렇지 않습니다.

두 번째는 사고(thinking) 과정입니다. Fable 5는 적응형 사고 기능이 항상 활성화되어 있으며 thinking: {"type": "disabled"}은 지원되지 않습니다. 사고 토큰은 전체 출력 요금으로 계산되어 출력 토큰으로 청구됩니다. 이 모델에서는 원시 사고 과정(raw chain of thought)이 반환되지 않으며, thinking.display은 기본적으로 "omitted"로 설정됩니다. 즉, 눈에 보이는 답변은 짧더라도 청구되는 출력 토큰 수는 많을 수 있습니다. Anthropic의 문서에는 청구되는 출력 토큰 수가 응답에 표시되는 토큰 수와 일치하지 않는다고 명시되어 있습니다.

추측하지 말고 분석 내용을 확인하십시오. usage.output_tokens_details.thinking_tokens 필드는 추론에 사용된 청구 대상 출력 토큰 수를 보고합니다.

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Anthropic의 사고 관련 문서에서 가져온 위 예시를 보면, 청구된 348개의 출력 토큰 중 312개가 사용자가 볼 수 없는 추론 과정에 사용되었습니다. 스트리밍 시 이 분석 정보는 마지막 message_delta 이벤트에서만 전달되므로, 마지막 텍스트 청크에서 읽기를 중단하는 클라이언트는 이를 기록할 수 없습니다.

제어 설정은 effort이며, output_config.effort으로 설정됩니다. 단계는 low, medium, high(기본값), xhigh, max이 있습니다.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

이 모델에 대한 Anthropic의 지침은 high에서 시작하고, 가장 높은 성능이 필요한 작업에만 xhigh으로 올리며, 일상적인 작업에는 medium 또는 low로 낮추는 것입니다. Fable 5에서 낮은 노력을 기울이는 것이 이전 모델의 xhigh보다 나은 결과를 내는 경우가 많기 때문입니다. 여기에는 두 가지 주의사항이 있습니다. 요청 간에 노력을 변경하면 프롬프트 캐시가 무효화됩니다. 결정된 노력 값이 프롬프트에 렌더링되기 때문이므로, 작업 부하별로 수준을 선택하고 일정하게 유지하십시오. 또한 max_tokens는 사고와 응답 텍스트를 합친 전체 출력에 대한 엄격한 제한이므로, 사고 과정이 없는 답변을 기준으로 설정된 제한은 내용을 잘라낼 수 있습니다. stop_reason: "max_tokens"가 표시된다면 제한을 높이거나 노력을 낮춰야 합니다.

토큰당 비용이 아닌 작업 완료당 비용

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

3행의 데이터는 벤치마크가 아니라 산술적인 계산 결과입니다. 요금은 공개되어 있습니다. 토큰 사용량은 가정이므로, 실제 사용 데이터의 수치로 대체해야 합니다. 중간 행과 같은 형태의 코딩 세션은 Fable 5에서 $5.00, Sonnet 5에서 $1.00의 비용이 발생합니다. 긴 실행(long run)의 경우 Fable 5는 $40.00, Sonnet 5는 $8.00입니다. 마지막 행의 Haiku 열은 단순 산술 계산일 뿐입니다. Haiku 4.5는 컨텍스트 윈도우가 200k 토큰이므로 해당 작업을 처리할 수 없습니다.

토큰당 비용은 의사결정을 위한 올바른 단위가 아닙니다. 작업 완료당 비용은 시도당 비용에 시도 횟수를 곱한 값입니다. 현재 요금 체계에서 Fable 5의 1회 시도 비용은 Sonnet 5의 5회 시도 비용과 같습니다. 따라서 재시도 횟수만으로는 업그레이드를 정당화하기 어렵습니다. Sonnet이 5번 중 4번 이상 실패해야만 저렴한 모델을 사용하는 것이 비용 측면에서 불리해집니다.

업그레이드를 정당화하는 요소는 토큰 청구서에 나타나지 않는 모든 것들입니다. 차트에서 두 긴 실행 사이의 비용 차이는 대부분의 시장에서 엔지니어의 1시간 인건비보다 작습니다. 고성능 모델을 사용하여 검토 시간을 1시간 절약하거나, 나중에 되돌려야 할 잘못된 마이그레이션을 한 번이라도 방지한다면, 청구서에는 드러나지 않지만 이미 비용을 회수하고도 남습니다. 비교 기준을 승인된 결과물당 비용으로 설정하고, 총비용에 본인의 시간 가치를 포함하십시오. 100만 토큰으로 실제로 무엇을 할 수 있는지 파악하면 이러한 추정치가 훨씬 더 구체적으로 변합니다.

Claude Fable 5가 제값을 하는 세 가지 작업

잘못된 경로 선택 시 비용이 큰 장기 에이전트 실행. Fable 5는 수 시간에 걸친 작업을 위해 설계되었습니다. 1M 토큰의 컨텍스트 윈도우, 요청당 최대 128k 출력 토큰, 그리고 30분 이상 실행되는 작업과 수백만 토큰 예산에 최적화된 xhigh 수준의 노력을 제공합니다. 40단계에서 에이전트가 잘못된 경로로 진입하여 300단계가 되어서야 발견되는 상황의 사후 수습 비용과 실행 비용을 비교해 보십시오.

대규모 코드베이스에서 일회성으로 수행하는 마이그레이션 또는 감사. 일회성 작업은 비용을 분산할 물량이 없으므로 토큰당 프리미엄이 단일 청구서에 합산되지만, 전체 작업을 하나의 컨텍스트 윈도우 내에서 처리할 수 있습니다. 비동기 실행이 가능하다면 Batch API를 통해 출력 토큰 백만 개당 $25 수준으로 비용을 절반으로 줄일 수 있습니다.

저렴한 모델이 이미 두 번 실패한 작업. 두 번의 실패와 그에 따른 디버깅 시간을 합치면 위의 차트에 명시된 물량 기준으로 Fable을 한 번 사용하는 것보다 더 많은 비용이 듭니다. 문제를 상위 모델로 이관하는 것이 더 경제적인 선택이며, 이것이 바로 모델 계층(model ladder)이 존재하는 이유입니다. 만약 여전히 일반적인 티어 선택을 고민 중이라면, Claude 모델 티어 간 성능 비교 페이지에서 이 페이지와는 다른 관점의 해답을 찾을 수 있습니다.

Sonnet 5 또는 Haiku 4.5가 정답인 세 가지 업무

대량 분류 및 추출 작업. 이 작업들은 처리량과 단위 비용으로 평가되며, 품질 상한선이 낮아 저렴한 모델로도 충분히 도달할 수 있습니다. Haiku 4.5가 정확하게 수행하는 작업에 Fable 5를 사용하면 10배의 비용을 지불하고도 측정 가능한 이득을 얻을 수 없습니다.

지연 시간이 제품의 핵심인 대화형 작업. Anthropic의 모델 표에 따르면 Fable 5의 상대적 지연 시간은 더 길며, 사고(thinking) 기능을 끌 수 없습니다. 챗봇이나 에디터 자동 완성 기능에서 사용자는 품질보다 대기 시간을 먼저 체감하므로, 더 뛰어난 모델을 사용하면 오히려 사용자 경험이 저하됩니다.

2026년 1월 이후의 사건에 의존하는 모든 작업. Fable 5의 신뢰할 수 있는 지식 컷오프는 2026년 1월입니다. 반면 Opus 5는 2026년 5월입니다. 더 비싼 모델이 오히려 최신 정보가 부족하므로, 검색이나 데이터 가져오기 도구를 제공하지 않는 한 최신 정보가 필요한 질문에 대해 더 많은 비용을 지불하고 더 오래된 지식을 얻게 됩니다.

비용과는 완전히 별개의 제약 사항이 하나 있습니다. Fable 5는 30일 데이터 보존 정책을 따르며, 'Covered Model'로 지정되어 있어 데이터 보존을 하지 않는(zero data retention) 옵션을 사용할 수 없습니다. 만약 귀하의 계약 조건에 데이터 보존 금지가 포함되어 있다면, Fable 5는 어떤 가격으로도 선택할 수 없으며 할인 여부와도 무관합니다.

fable-method 저장소가 보여주는 것과 보여주지 않는 것

실무자들은 Fable 5의 접근 방식을 더 저렴한 모델이 따라 할 수 있는 기술로 정제한 저장소를 공개했습니다. fable-method 저장소는 사고 기술, 오케스트레이션 루프, 그리고 에이전트의 보고서를 읽는 대신 주장된 모든 검증을 다시 실행하는 적대적 검증기를 설명합니다. README에는 "이것은 커뮤니티의 요약본이며, Anthropic의 공식 산출물이 아닙니다"라고 명시되어 있습니다.

이 내용을 그대로 받아들여야 합니다. 이는 사람들이 모델을 어떻게 구동하는지에 대한 증거일 뿐, 모델이 어떻게 작동하는지에 대한 문서가 아닙니다. 그 내용 중 Anthropic이 검증한 것은 없으며, 사양(spec)이 아닌 민간 전승(folklore)에서 예상할 수 있듯이 서로 다른 표현을 사용하는 거의 동일한 포크(fork)가 여러 개 존재합니다.

비용 결정을 위해 참고할 만한 신호는 사람들이 복제할 가치가 있다고 판단한 부분이 절차적이라는 점입니다. 작업을 분류하고, 완료를 증명할 검증 항목을 명명하고, 결정하기 전에 증거를 수집한 다음, 요약을 읽는 대신 관찰을 통해 검증하십시오. 명시적인 체크리스트와 검증 단계를 제공받은 저렴한 모델은 성능 격차의 일부를 해소할 수 있으므로, 고가의 모델을 표준화하기 전에 자체 평가 세트에서 해당 실험을 수행해 보십시오. 결과는 귀하의 작업에 따라 달라지며, 이것이 바로 다른 사람의 수치가 귀하에게 큰 의미가 없는 이유입니다.

예산을 확정하기 전에 직접 수치를 확인하십시오

  • 모든 응답에서 usage을 읽고, output_tokens_details.thinking_tokens은 가시적인 출력과 별도로 기록하십시오. 보이지 않는 추론 과정이 예산을 초과하게 만드는 주범입니다.
  • 기본값을 그대로 사용하지 말고 effort를 명시적으로 설정하십시오. 프롬프트 캐싱을 사용하는 대화 내내 이 값을 일정하게 유지해야 합니다.
  • 안정적인 접두사를 캐시 중단점 뒤에 배치하십시오. 기본 입력 비용의 10분의 1 수준인 캐시 읽기 비용은 대부분의 모델 하향 조정보다 더 큰 절감 효과를 가져옵니다.
  • 즉각적인 답변이 필요하지 않은 작업은 Batch API로 옮기십시오.
  • 대안의 가격을 정직하게 산정하십시오. Claude와 ChatGPT API 가격 비교를 자신의 작업 부하에 맞춰 직접 수행해 보는 것은 장기 계약 전 오후 시간을 투자할 가치가 충분합니다.

작업 부하가 자체 서버에서 실행되는 에이전트라면, 가장 중요한 제어 요소는 모델 선택 외부에 있습니다. VPS에서 에이전트 비용 제어하기는 세션 폭주를 막는 루프 제한과 지출 한도를 다루며, Claude Code가 실제로 토큰을 사용하는 곳에서는 사용량 대시보드에서 확인하게 될 수치들에 대해 설명합니다.

FAQ

Claude Fable 5의 백만 토큰당 비용은 얼마입니까?

Claude Fable 5는 2026년 8월 3일 Anthropic 가격 페이지 기준으로 Claude API에서 입력 토큰 백만 개당 $10, 출력 토큰 백만 개당 $50로 책정되어 있습니다. 캐시 읽기 비용은 기본 입력 요금의 10분의 1인 백만 토큰당 $1입니다. Batch API는 비동기 작업에 대해 양쪽 모두 50% 할인된 백만 토큰당 $5$25 요금을 적용합니다. inference_geo 매개변수를 사용하여 추론을 미국 내로 제한할 경우 모든 항목에 1.1배의 배수가 적용됩니다.

Claude Fable 5는 Claude Pro 구독에 포함되어 있습니까?

Anthropic의 Claude Fable 페이지에 따르면 해당 모델은 Pro, Max, Team 및 Enterprise 사용자에게 제공되며 무료 플랜은 명시되어 있지 않습니다. 포함된 액세스 권한이 무제한은 아닙니다. 일부 사용자는 주간 사용량 제한의 일부로 Fable에 접근하며, 다른 사용자는 사용 크레딧을 통해 접근합니다. 이러한 방식은 2026년 7월 중 여러 차례 변경되었습니다. 기사에 기재된 수치를 신뢰하기보다 결정하는 당일에 Anthropic 가격 페이지의 플랜 비교 표에서 Fable 항목을 확인하십시오. 포함된 허용량을 모두 소진하면 이후 사용량은 API 요금으로 청구됩니다.

Claude Fable 5 청구 금액이 실제 출력물보다 높은 이유는 무엇입니까?

Claude Fable 5는 적응형 사고(Adaptive thinking) 기능이 항상 활성화되어 있으며, 사고 토큰은 출력 토큰으로 청구됩니다. 원시 사고 과정(chain of thought)은 반환되지 않습니다. thinking.display이 기본값인 omitted로 설정된 경우, 사고 토큰에 대한 비용을 지불하면서도 빈 사고 필드만 보게 됩니다. 응답에서 usage.output_tokens_details.thinking_tokens을 읽어 분할된 토큰을 확인하십시오. 스트리밍 시에는 마지막 message_delta 이벤트에서만 해당 정보가 전달된다는 점에 유의하십시오. 작업에 필요한 수준보다 추론 대 답변 비율이 높다면 effort 수준을 낮추십시오.

Claude Fable 5와 Claude Opus 5 중 무엇을 사용해야 합니까?

Claude Opus 5는 토큰당 비용이 절반 수준이며, 지식 차단 시점이 2026년 5월로 Fable 5의 2026년 1월보다 더 최신입니다. 먼저 Opus 5로 시작하고 해당 모델에서 작업이 실패하거나 잘못된 답변으로 인한 비용이 가격 차이보다 클 때 상위 모델로 전환하십시오. Fable 5는 잘못된 분기 하나가 몇 시간의 정리 작업을 유발할 수 있는 장기 에이전트 작업이나, 프리미엄 비용이 모든 요청에 영구적으로 부과되는 대신 단일 청구서로 처리되는 일회성 작업에 적합합니다.

#claude#fable#model-selection#pricing#tokens