SSD Nodes Learn 🎉 VPS $5.50/月〜
ガイド Matt Connor著者 Matt Connor ・更新日 2026-08-13

Claude Fable 5の料金と使いどころ

Claude Fable 5は入力100万トークン10ドル、出力50ドルです。Sonnet 5の導入価格が2026年9月1日に変わる点も含め、実際の用途別に料金の意味を解説します。

Claude Fable 5 の料金はいくらですか?

Claude API での Claude Fable 5 の料金は、入力 100 万トークンあたり $10、出力 100 万トークンあたり $50 です。これは Anthropic が公開している定価で、2026 年 8 月 3 日に料金ページから取得したものです。API のモデル ID は claude-fable-5 です。2026 年 6 月 9 日に Claude API、Amazon Bedrock、AWS 上の Claude Platform、Google Cloud、Microsoft Foundry で一般提供が開始されました。

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

料金は段階的に見ると分かりやすくなります。Fable 5 の定価は Claude Opus 5 の 2 倍、現在の Claude Sonnet 5 の 5 倍、Claude Haiku 4.5 の 10 倍です。すべてのモデルで、出力料金は入力料金のちょうど 5 倍に設定されているため、この比率は入力と出力の両方で同じです。そのため、ジョブの入力トークンと出力トークンの比率が分かれば、1 つの料金に倍率を掛けて別のモデルの料金を算出できます。

1 つの日付によって計算が変わります。Sonnet 5 は 2026 年 8 月 31 日まで、入力 100 万トークンあたり $2、出力 100 万トークンあたり $10 の導入価格です。2026 年 9 月 1 日からは、入力 100 万トークンあたり $3、出力 100 万トークンあたり $15 になります。Fable 5 自体の料金は変わらないため、その日に両者の差は 5 倍から 3 倍強に縮まります。秋の予算を作成する場合は、後者の Sonnet の料金を使用してください。

割引と、料金を引き上げる唯一の倍率

プロンプトキャッシュが最も大きな効果をもたらします。キャッシュ読み取りの料金は通常の入力料金の 10 分の 1 で、Fable 5 では 100 万トークンあたり $1 です。キャッシュへの書き込みは通常の入力トークンより高く、5 分間キャッシュでは通常料金の 1.25 倍、1 時間キャッシュでは 2 倍です。5 分間キャッシュは 1 回読み取るだけで元が取れ、1 時間キャッシュは 2 回読み取ると元が取れます。この計算だけで、すべての箇所で有効化する前に プロンプトキャッシュが損益分岐点に達する条件を確認する理由が分かります。

Batch API は入力と出力の両方を 50% 割り引くため、Fable 5 のバッチ処理は 100 万トークンあたり $5$25 です。バッチリクエストは非同期で処理されるため、すぐに回答が必要ない処理にだけ有効です。この 2 つの割引は併用できるため、キャッシュを使用するバッチ処理では入力と出力の両方を低コストにできます。

1M トークンのコンテキストウィンドウは、Claude 4.6 以降のモデルで標準料金に含まれています。長いコンテキストに対する追加料金はないため、900k トークンのリクエストも 9k トークンのリクエストも、トークンあたりの料金は同じです。

料金を引き上げる倍率はデータレジデンシーです。推論を米国内に限定するために inference_geo: "us" を設定すると、キャッシュ読み取りやキャッシュ書き込みを含むすべてのトークン区分に 1.1 倍の倍率が適用されます。契約上の要件がない限り、デフォルトのグローバルルーティングを使用してください。

このモデルには固有の請求ルールが 1 つあります。Fable 5 には、安全性分類器が組み込まれており、リクエストを拒否することがあります。その場合、Messages API はエラーではなく、成功を示す HTTP 200 レスポンスとして stop_reason: "refusal" を返します。出力が生成される前に拒否されたリクエストには課金されません。同じプロンプトを別の Claude モデルで再試行した場合は、フォールバッククレジットにより、切り替えに伴うプロンプトキャッシュ料金が返金されます。そのため、同じキャッシュを 2 回ウォームアップする料金を支払う必要はありません。

Claude Fable 5を利用できるプランはどれですか?

2026年8月3日時点で、AnthropicのClaude Fableページでは、このモデルはPro、Max、Team、Enterpriseのユーザーが利用できるとされています。無料プランは記載されていません。その一覧で最も安いシートはProです。そのため、Proの料金と利用制限に達する条件が、Fableをサブスクリプションで利用する場合の最低ラインになります。開発者向けには、Claude APIと、上記のクラウドマーケットプレイスを通じて一般提供されています。この方法に無料枠はないため、メーターが動き始める前に利用できるのは、Anthropicがサインアップ時に付与する少額のクレジットだけです。

プランで利用できることと、無制限で含まれることは同じではありません。Anthropicの料金ページにあるプラン比較表では、一部のシートでFableの利用が週次利用上限の一定割合までに制限され、別のシートでは利用クレジットが適用されます。この仕組みは2026年7月中に複数回変更されました。Fable 5の再展開に関するAnthropic自身の発表では、Pro、Max、Team、および一部のEnterpriseプランで、2026年7月7日までは週次利用上限の最大50%までモデルを利用でき、それ以降は利用クレジットが適用されるとされていました。7月後半の報道では、さらに期間が延長され、シートの種類によって扱いが分かれたと説明されています。

そのため、このページではプランごとの上限を掲載しません。その月に公表された数値は2週間も有効だったものがなく、古い数値を掲載するより、掲載しないほうが適切です。契約を決める日に、プラン比較表でFableと表示された行を確認してください。ニュース記事にある数値は、古くなっているものとして扱ってください。Fableを利用するためにシートを契約し、実際の利用枠が表から想定したより少ない場合でも、次回更新前に下位プランへ戻すことで、すでに支払った月の利用権は維持できます。

安定しているのはAPIの料金です。どの経路でも、含まれる利用枠を使い切ると、それ以降のFable 5の利用には上記の料金表に記載された料金が課金されます。Enterpriseではこの構造が明確です。Enterpriseのシート料金でアクセス権を購入し、トークンには別途API料金が適用されるためです。したがって、どちらの方法でも、計画の基準にすべき数値は料金表です。これは、他のClaudeモデルについてAPI課金とサブスクリプションを比較する場合と同じ結論になります。まだティアを選んでいない場合は、利用状況に合うClaudeプランから確認してください。そのシートをFable専用ではなく日常的なアシスタントとしても使う場合は、契約前にClaudeの各プランとChatGPTの料金を比較する方法も確認するとよいでしょう。

価格比から想定するより請求額が高くなる理由

文書化されている2つの仕組みにより、Fable 5の料金は単純な価格比較から想定される額を上回ります。

1つ目はtokenizerです。Fable 5はClaude Opus 4.7で導入されたtokenizerを使用します。Opus 4.7より前にリリースされたモデルと比較すると、同じテキストでも生成されるトークン数はおよそ30%多くなります。正確な増加率は内容によって異なります。Haiku 4.5はこのtokenizerより前のモデルであるため、同じテキストを両方のモデルに入力すると、料金表上の10倍の差は約13倍になります。Sonnet 5は新しいtokenizerを使用するため、Fableとの比較は1トークン当たりの料金として公平です。FableとHaikuの比較は公平ではありません。

2つ目はthinkingです。Fable 5ではAdaptive thinkingが常に有効で、thinking: {"type": "disabled"}はサポートされません。Thinking tokensは、出力トークンとして通常の出力料金で課金されます。このモデルでは生のchain of thoughtは返されません。また、thinking.displayのデフォルト値は"omitted"です。そのため、表示される回答が短くても、課金対象の出力トークン数が大きくなる場合があります。Anthropicのドキュメントにも明記されています。課金対象の出力トークン数は、レスポンスに表示されるトークン数とは一致しません。

推測せず、内訳を確認してください。usage.output_tokens_details.thinking_tokensフィールドには、課金対象の出力トークンのうち、推論に使用された数が示されます。

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

この例はAnthropicのthinkingドキュメントから引用したものです。課金対象の出力トークン348個のうち、312個は誰にも表示されない推論に使用されています。ストリーミング時、この内訳は最後のmessage_deltaイベントでのみ届きます。そのため、最後のテキストチャンクを受信した時点で読み取りを停止するクライアントでは、この内訳を記録できません。

制御する項目はeffortです。output_config.effortに設定し、レベルはlowmediumhigh(デフォルト)、xhighmaxから選択します。

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Anthropicは、このモデルではまずhighから開始し、能力が特に重要な処理だけxhighに上げ、通常の処理ではmediumまたはlowに下げるよう案内しています。Fable 5では、努力量を下げた方が、以前のモデルでxhighを使用するより性能が高い場合が多いためです。ここには2つの注意点があります。リクエストごとに努力量を変更すると、prompt cacheが無効になります。解決済みの努力量がpromptに展開されるためです。そのため、ワークロードごとにレベルを決め、一定に保ってください。また、max_tokensはthinkingとレスポンステキストを合わせた総出力の上限です。thinkingを使用しない回答向けに設定した上限では、回答が途中で切れることがあります。stop_reason: "max_tokens"が表示された場合は、上限を引き上げるか、努力量を下げてください。

完了タスクあたりのコストで判断し、トークンあたりのコストでは判断しない

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

これらの 3 行はベンチマークではなく、算術計算です。料金は公開されています。トークン量は仮定値なので、自分の利用データの値に置き換えてください。中央の行に相当するコーディングセッションのコストは、Fable 5 では $5.00、Sonnet 5 では $1.00 です。長時間の実行では、Fable 5 が $40.00、Sonnet 5 が $8.00 です。最後の行の Haiku 列は算術計算にすぎません。Haiku 4.5 のコンテキストウィンドウは 200k トークンなので、そのジョブをまったく収められません。

意思決定の単位として、トークンあたりのコストは適切ではありません。完了タスクあたりのコストは、1 回の試行コストに試行回数を掛けたものです。現在の料金では、Fable 5 の 1 回の試行は Sonnet 5 の 5 回の試行と同じコストです。そのため、再試行回数だけを理由にアップグレードすることはほとんどありません。トークン単価で安い方法が不利になるのは、Sonnet が 5 回中 4 回を超えて失敗する場合です。

アップグレードを正当化するのは、トークン料金に含まれないすべての要素です。図にある2つの長時間実行の差額は、ほとんどの市場でエンジニアの作業時間1時間分より小さい金額です。高価なモデルによってレビュー時間を1時間削減できる場合や、後で修正が必要になる不適切なマイグレーションを1件回避できる場合、その節約額は請求額には表示されなくても、すでに追加コストを回収しています。比較は承認済みの成果1件あたりの金額で行い、自分の作業時間も合計に含めてください。100万トークンで実際に何ができるかを知ることで、この見積もりをより具体的に把握できます。

Claude Fable 5 が価格に見合う3つの用途

誤った分岐の修正コストが高い、長時間のエージェント実行。 Fable 5 は、数時間単位で測る作業を想定して設計されています。1M token のコンテキストウィンドウ、1リクエストあたり最大 128k output token、そして30分を超えて実行するタスクを対象とした xhigh effort level を備えています。エージェントが step 40 で誤った分岐に進み、誰も気づかないまま step 300 まで進んだ場合の後始末と、実行コストを比較してください。

大規模なコードベース全体に対して1回だけ実行する移行または監査。 1回限りの作業では、実行量によって単価を分散できません。そのため、token 単価の上乗せ分が1つの請求にそのまま反映されます。また、作業全体が1つのコンテキストウィンドウに収まる場合もあります。非同期で実行できるなら、Batch API により、output token 100万個あたりの料金を半額の $25 にできます。

より安価なモデルがすでに2回失敗したタスク。 2回の失敗とデバッグ時間を合わせると、上の表に示した利用量では、Fable を1回使うより高くつきます。より上位のモデルへ切り替える方が安く済みます。これが model ladder の用途です。一般的にどの tier を選ぶかで迷っている場合は、Claude model tier の能力比較を参照してください。このページとは異なる問いに答えています。

Sonnet 5 または Haiku 4.5 が適切な選択となる3つの仕事

大量の分類と抽出。 これらの仕事はスループットと単価で評価され、品質の上限も安価なモデルで十分に到達できる程度です。Haiku 4.5 が正しく完了できるタスクに10倍の料金を支払っても、Fable 5 から測定可能な利点は得られません。

レイテンシーが製品価値そのものである対話的な作業。 Anthropic のモデル表では、Fable 5 の比較レイテンシーは遅く、thinking を無効にできないとされています。チャットボックスやエディターの補完では、より高性能なモデルのほうが使い勝手が悪くなります。ユーザーは品質を評価する前に待ち時間を意識するためです。

2026年1月以降のイベントに依存する作業。 Fable 5 の信頼できる知識カットオフは2026年1月です。Opus 5 は2026年5月です。高価なモデルのほうが情報が古いため、最新情報に関する質問では、検索または取得ツールを渡さない限り、古い知識に対して2倍の料金を支払うことになります。

コストとは別に、1つの制約があります。Fable 5 は30日間のデータ保持を伴い、ゼロデータ保持では利用できません。Covered Model に指定されているためです。契約でゼロ保持が必要な場合、Fable 5 は料金にかかわらず選択肢になりません。割引でもこの制約は変わりません。

Fable-method リポジトリが示すことと、示さないこと

実務者は、Fable 5 のアプローチを、より安価なモデルでも実行できるスキルに整理したリポジトリを公開しています。fable-method repo には、思考スキル、オーケストレーションループ、そしてエージェント自身の報告を読むのではなく、主張されたすべてのチェックを再実行する敵対的検証器が記載されています。README でも、「これはコミュニティによる整理であり、Anthropic の成果物ではない」と明記されています。

このリポジトリは、まさにそのようなものとして扱ってください。これは、人々がモデルをどのように動かしているかを示す証拠であり、モデルの動作原理に関するドキュメントではありません。Anthropic による検証は一切行われていません。また、文言が異なるほぼ同一のフォークも複数存在します。これは仕様書というより、伝承的な知見に見られる特徴です。

コストを判断するうえで注目すべき点は、人々がコピーする価値があると考えた部分が手順だったことです。タスクを分類し、完了を証明するチェックを明確にし、判断する前に証拠を集め、要約を読むのではなく観測によって検証します。安価なモデルに明示的なチェックリストと検証手順を渡すことで、差の一部を埋められます。そのため、高価なモデルを標準として採用する前に、自分の評価セットでこの実験を実行してください。結果はタスクによって異なるため、他者の数値はあなたにとってあまり意味を持ちません。

予算を確定する前に、自分の数値を確認します

  • すべての応答で usage を確認し、output_tokens_details.thinking_tokens を表示出力とは別に記録します。見えない推論が、予想外の費用項目になります。
  • デフォルト値をそのまま使わず、effort を明示的に設定します。プロンプトキャッシュに依存する会話では、その値を途中で変更しないでください。
  • まず、安定したプレフィックスをキャッシュブレークポイントの後ろに配置します。入力の基準価格の 10 分の 1 でキャッシュを読み取れるため、多くのモデルのダウングレードより大きな削減効果があります。
  • すぐに回答する必要がない処理は、Batch API に移します。
  • 代替案の価格を正確に比較します。自分のワークロードで Claude と ChatGPT API の料金を比較する ことは、長期的な契約を決める前に半日をかける価値があります。

ワークロードが自分のサーバー上で動作するエージェントの場合、最も重要な制御項目はモデルの選択以外にあります。VPS 上でエージェントのコストを制御する では、暴走するセッションを停止するループ制限と支出上限を説明し、Claude Code が実際にトークンを消費する場所 では、使用量ダッシュボードに表示される数値を説明します。

FAQ

Claude Fable 5 の 100 万トークンあたりの料金はいくらですか?

Claude API では、2026 年 8 月 3 日に Anthropic の料金ページで確認した時点で、Claude Fable 5 の料金は入力トークン 100 万個あたり $10、出力トークン 100 万個あたり $50 です。キャッシュ読み取りはトークン 100 万個あたり $1 で、基本入力料金の 10 分の 1 です。Batch API では入力と出力の両方が 50% 割引になり、非同期処理の料金はそれぞれトークン 100 万個あたり $5$25 です。inference_geo パラメーターを使用して推論を米国内に限定すると、すべてのカテゴリに 1.1 倍の係数が適用されます。

Claude Pro サブスクリプションに Claude Fable 5 は含まれますか?

Anthropic の Claude Fable ページでは、このモデルを Pro、Max、Team、Enterprise のユーザーが利用できると記載しており、無料プランについては記載していません。含まれる利用枠は無制限ではありません。一部のシートでは週次利用上限の一部として Fable を利用でき、別のシートでは利用クレジットを通じて利用できます。この扱いは 2026 年 7 月中にも複数回変更されました。契約を決める日に Anthropic の料金ページのプラン比較表で Fable の行を確認し、記事に記載された数値だけを信用しないでください。含まれる利用枠を使い切ると、それ以降の利用には API 料金が課金されます。

Claude Fable 5 の請求額が、表示された出力から想定するより高いのはなぜですか?

Claude Fable 5 では適応型思考が常に有効で、思考トークンは出力トークンとして課金されます。また、内部の思考過程そのものが返されることはありません。thinking.display がデフォルトの omitted の場合、思考フィールドは空に見えますが、その背後で生成されたすべての推論トークンに対して料金が発生します。応答内の usage.output_tokens_details.thinking_tokens を確認すると内訳が分かります。ストリーミング時は、最後の message_delta イベントでのみ送信される点に注意してください。推論と回答の比率がタスクに必要な水準を超えている場合は、effort のレベルを下げてください。

Claude Fable 5 と Claude Opus 5 のどちらを使うべきですか?

Claude Opus 5 はトークン単価が半額で、信頼できる知識カットオフも新しく、Fable 5 の 2026 年 1 月に対して 2026 年 5 月です。まず Opus 5 で開始し、そこでタスクに失敗した場合、または誤答による損失が価格差を上回る場合に Fable 5 へ切り替えてください。Fable 5 は、1 つの誤った分岐によって数時間の後処理が必要になる長期的なエージェント処理に適しています。また、追加料金がすべてのリクエストに継続して発生するのではなく、1 回の請求に集約される単発の処理にも適しています。

#claude#fable#model-selection#pricing#tokens