SSD Nodes Learn 🎉 VPS $4.99/月〜
ガイド Matt Connor著者 Matt Connor ・更新日 2026-08-04

Claude Fable 5の料金と使いどころ

Claude Fable 5は入力100万トークンあたり$10、出力100万トークンあたり$50です。公開料金が実際の処理やSonnet 5との比較で何を意味するか、キャッシュ料金も含めて解説します。

Claude Fable 5 の料金はいくらですか?

Claude Fable 5 の料金は、Claude API で入力トークン 100 万件あたり $10、出力トークン 100 万件あたり $50 です。これは Anthropic が公開している料金表の価格で、2026 年 8 月 3 日に料金ページから確認したものです。API のモデル ID は claude-fable-5 です。2026 年 6 月 9 日に、Claude API、Amazon Bedrock、AWS 上の Claude Platform、Google Cloud、Microsoft Foundry で一般提供が開始されました。

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

この価格関係は段階的になっています。Fable 5 の料金は Claude Opus 5 の 2 倍、現在の Claude Sonnet 5 の 5 倍、Claude Haiku 4.5 の 10 倍です。すべてのモデルで、出力料金が各モデルの入力料金のちょうど 5 倍に設定されているため、請求の入力側と出力側で比率は同じです。そのため、ある処理における入力トークンと出力トークンの比率が分かれば、乗算によって 1 つの料金を別の料金に換算できます。

1 つの日付が計算結果を変えます。Sonnet 5 は 2026 年 8 月 31 日まで、入力トークン 100 万件あたり $2、出力トークン 100 万件あたり $10 の導入価格です。2026 年 9 月 1 日からは、入力トークン 100 万件あたり $3、出力トークン 100 万件あたり $15 になります。Fable 5 自体の料金は変わらないため、その日に両者の差は 5 倍から 3 倍強に縮まります。秋の予算を作成する場合は、後者の Sonnet の料金を使用してください。

割引と、逆方向に働く 1 つの倍率

プロンプトキャッシュが最大の効果を持ちます。キャッシュの読み取り料金は通常の入力料金の 10 分の 1 で、Fable 5 では 100 万トークンあたり $1 です。キャッシュへの書き込みは通常の入力トークンより高く、5 分間キャッシュでは基準料金の 1.25 倍、1 時間キャッシュでは 2 倍です。5 分間キャッシュは 1 回読み取るだけで元が取れ、1 時間キャッシュは 2 回読み取ると元が取れます。すべての箇所で有効にする前に、プロンプトキャッシュの損益分岐点を確認する理由はこの計算だけです。

Batch API は入力と出力の両方を 50% 割り引くため、Fable 5 のバッチ処理は 100 万トークンあたり $5$25 です。バッチリクエストは非同期で処理されるため、すぐに応答が必要ない処理に限って効果があります。この 2 つの割引は併用できるため、キャッシュを利用するバッチ処理では入力と出力の両方を安くできます。

1M トークンのコンテキストウィンドウは、Claude 4.6 以降のモデルで標準料金に含まれます。長いコンテキストに対する追加料金はないため、900k トークンのリクエストも 9k トークンのリクエストも、トークンあたりの料金は同じです。

請求額を増やす倍率はデータレジデンシーです。推論を米国内に限定するよう inference_geo: "us" を設定すると、キャッシュの読み取りと書き込みを含むすべてのトークン区分に 1.1 倍の倍率が適用されます。契約上の要件がない限り、デフォルトのグローバルルーティングを使用してください。

このモデルには固有の請求ルールが 1 つあります。Fable 5 には、リクエストを拒否できる安全性分類器が組み込まれています。この場合、Messages API はエラーではなく、成功を示す HTTP 200 応答として stop_reason: "refusal" を返します。出力が生成される前に拒否されたリクエストには料金が発生しません。同じプロンプトを別の Claude モデルで再試行すると、フォールバッククレジットにより切り替えに伴うプロンプトキャッシュ料金が返金されるため、同じキャッシュを 2 回ウォームアップする料金を支払わずに済みます。

Claude Fable 5 が含まれるプランはどれですか?

2026年8月3日時点で、Anthropic の Claude Fable ページでは、このモデルは Pro、Max、Team、Enterprise のユーザーが利用できると説明されています。Free プランは記載されていません。開発者向けには、Claude API と、上記のクラウドマーケットプレイスを通じて一般提供されています。

プランで利用できることと、無制限で含まれることは同じではありません。Anthropic の料金ページにあるプラン比較表では、一部のシートで Fable の利用に週次使用量上限の一部が適用され、その他のシートでは使用クレジットが適用されます。この仕組みは2026年7月中に複数回変更されました。Anthropic が Fable 5 の再提供について発表した内容では、Pro、Max、Team、および一部の Enterprise プランで、2026年7月7日まで週次使用量上限の最大50%までモデルを利用でき、それ以降は使用クレジットが適用されるとされていました。7月後半の報道では、さらに期間が延長され、シートの種類によって扱いが分かれたと説明されています。

そのため、このページではプランごとの上限を掲載しません。その月に公開された数値はどれも2週間維持されず、古い数値を掲載するより、掲載しないほうが適切です。利用する日にプラン比較表の Fable と記載された行を開いて確認し、ニュース記事にある数値は古い情報として扱ってください。

安定しているのは API の料金です。どの経路でも、含まれる利用枠を使い切ると、それ以降の Claude Fable 5 の利用には上の表に記載された料金が請求されます。したがって、どちらの場合も計画の基準にすべきなのは料金表です。これは、他の Claude モデルについて API の請求とサブスクリプションを比較する場合と同じ結論になります。まだプランを選んでいない場合は、まず 利用状況に合う Claude プランから確認してください。

価格差だけでは説明できないほど請求額が高くなる理由

Fable 5 が単純な価格比較から想定されるより高くなる理由は、文書化された2つの仕組みにあります。

1つ目は tokenizer です。Fable 5 は Claude Opus 4.7 で導入された tokenizer を使用します。Opus 4.7 より前にリリースされたモデルと比較すると、同じテキストでも生成されるトークン数が約30%増えます。正確な増加率は内容によって異なります。Haiku 4.5 はこの tokenizer より前のモデルです。そのため、同じテキストを両方のモデルに入力すると、価格表上の10倍の差は実質的に約13倍になります。Sonnet 5 は新しい tokenizer を使用するため、Fable と Sonnet の比較はトークン単価の比較として公平です。Fable と Haiku の比較は公平ではありません。

2つ目は thinking です。Fable 5 では adaptive thinking が常に有効で、thinking: {"type": "disabled"} はサポートされません。thinking tokens は output tokens として、通常の出力単価で課金されます。このモデルでは、生の chain of thought が返されることはありません。また、thinking.display のデフォルト値は "omitted" です。そのため、表示される回答が短くても、課金対象の出力トークン数が大きくなる場合があります。Anthropic のドキュメントにも明記されているとおり、課金対象の output token 数はレスポンスに表示されるトークン数と一致しません。

推測せず、内訳を確認してください。usage.output_tokens_details.thinking_tokens フィールドには、reasoning に使用された課金対象の output token 数が示されます。

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Anthropic の thinking ドキュメントにあるこの例では、課金対象の348 output tokens のうち312が、表示されない reasoning に使われています。ストリーミング時、この内訳が届くのは最後の message_delta event だけです。そのため、最後の text chunk で読み取りを停止するクライアントでは、この内訳を記録できません。

制御するのは effort です。output_config.effort に設定し、レベルは lowmediumhigh(デフォルト)、xhighmax から選択します。

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Anthropic は、このモデルではまず high から開始し、特に能力が重要な処理だけ xhigh に上げ、通常の処理では medium または low に下げるよう案内しています。Fable 5 では、努力量を下げたほうが、以前のモデルで xhigh を使用するより高い性能になることが多いためです。

ここには2つの注意点があります。リクエストごとに effort を変更すると、prompt cache が無効になります。解決済みの effort 値が prompt に展開されるためです。ワークロードごとにレベルを決め、一定に保ってください。また、max_tokens は output 全体の上限です。thinking と response text の合計に適用されるため、thinking を使用しない回答向けに設定した上限では、回答が途中で切れることがあります。stop_reason: "max_tokens" が表示された場合は、上限を引き上げるか effort を下げてください。

完了タスクあたりのコストで比較する

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

この 3 行はベンチマークではなく、算術計算です。料金は公開されています。トークン量は仮定なので、自分の利用データに基づく数値へ置き換えてください。中央の行に相当するコーディングセッションの費用は、Fable 5 では $5.00、Sonnet 5 では $1.00 です。長時間の実行では、Fable 5 が $40.00、Sonnet 5 が $8.00 です。最後の行の Haiku 列は算術計算上の値にすぎません。Haiku 4.5 のコンテキストウィンドウは 200k トークンなので、そのジョブを保持できません。

トークンあたりのコストは、判断に適した単位ではありません。完了タスクあたりのコストは、1 回の試行コストに試行回数を掛けたものです。現在の料金では、Fable 5 の 1 回の試行にかかる費用は Sonnet 5 の 5 回の試行と同じです。そのため、再試行回数だけでアップグレードを正当化できることはほとんどありません。トークン単位で安価な方法が不利になるには、Sonnet が 5 回中 4 回を超えて失敗する必要があります。

アップグレードを正当化するのは、トークン料金に含まれないすべての要素です。グラフに示した2つの長時間実行の差額は、ほとんどの市場ではエンジニアの作業時間1時間分より小さい金額です。高価なモデルによってレビュー時間を1時間削減できる場合や、後から修正が必要になる不適切な移行を1件回避できる場合、そのモデルはすでに元が取れています。ただし、その節約額は請求額には表示されません。比較は受け入れ可能な結果1件あたりの金額で行い、自分の作業時間も合計に含めてください。100万トークンで実際に何ができるかを知ることで、この見積もりをより具体的に把握できます。

Claude Fable 5 が価格に見合う 3 つの仕事

誤った分岐のコストが大きい、長時間のエージェント実行。 Fable 5 は、時間単位で処理する作業向けに設計されています。1M token のコンテキストウィンドウ、1 リクエストあたり最大 128k output token、さらに数百万単位の token budget を使い、30 分を超えて実行するタスクを想定した xhigh effort level を備えています。エージェントが step 40 で誤った分岐に進み、それに誰も気付かないまま step 300 まで進んだ場合の後処理と、実行コストを比較してください。

大規模な codebase 全体に対して 1 回だけ実行する移行または監査。 1 回限りの作業には、実行量でコストを平準化する余地がありません。そのため、token 単価の上乗せ分が 1 回の請求にそのまま反映され、作業全体が 1 つのコンテキストウィンドウに収まる場合もあります。非同期で実行できる場合は、Batch API により、100 万 output token あたり $25 まで半額になります。

より安価な model ですでに 2 回失敗しているタスク。 2 回の失敗とデバッグにかかる時間を合わせると、上の表の利用量では、Fable 5 を 1 回使う方が安くなります。上位の model に切り替えることが低コストの選択肢であり、そのために model ladder があります。全般的な tier の選択でまだ迷っている場合は、Claude model tier 間の機能比較 を参照してください。このページとは異なる問いに答えています。

Sonnet 5 または Haiku 4.5 が適切な選択となる3つの用途

大量の分類と抽出。 これらの処理はスループットと単位コストで評価され、必要な品質の上限も低いため、安価なモデルで十分に達成できます。Haiku 4.5 が正しく完了できる処理に10倍の料金を支払っても、Fable 5 から測定可能な追加効果は得られません。

レイテンシが製品価値となる対話処理。 Anthropic のモデル一覧では、Fable 5 の相対的なレイテンシはより遅いとされています。また、thinking を無効にできません。チャットボックスやエディターの補完では、より高性能なモデルのほうが体感品質が低下します。ユーザーは品質を評価する前に待ち時間を認識するためです。

2026年1月以降の事象に依存する処理。 Fable 5 の信頼できる知識カットオフは2026年1月です。Opus 5 のカットオフは2026年5月です。高価なモデルのほうが最新情報に乏しいため、最新性が必要な質問では、検索または fetch ツールを渡さない限り、古い知識に対して2倍の料金を支払うことになります。

コストとは別に、1つの制約があります。Fable 5 には30日間のデータ保持が適用され、zero data retention では利用できません。これは Covered Model に指定されているためです。契約で zero retention が必要な場合、Fable 5 はどのような料金でも選択肢にならず、割引によってこの制約が変わることもありません。

fable-method リポジトリが示すこと、示さないこと

実務者は、Fable 5 のアプローチを低コストのモデルでも実行できるスキルに整理したリポジトリを公開しています。fable-method リポジトリでは、思考スキル、オーケストレーションループ、敵対的検証器について説明しています。この検証器は、エージェント自身の報告を読むのではなく、主張されたすべてのチェックを再実行します。README にも「これはコミュニティによる整理であり、Anthropic の成果物ではない」と明記されています。

その位置付けをそのまま受け入れてください。これは、人々がモデルをどのように動かしているかを示す証拠であり、モデルの動作原理を説明するドキュメントではありません。Anthropic によって検証された内容は含まれていません。ほぼ同一のフォークが異なる文面で複数存在することも、仕様書ではなく伝承に近いものから予想される状況です。

コスト面の判断に役立つ情報は、人々がコピーする価値があると判断した部分が手順化されていることです。タスクを分類し、完了を証明するチェックを明確にし、判断する前に証拠を集め、要約を読むのではなく観測によって検証します。低コストのモデルに明示的なチェックリストと検証手順を与えることで、差の一部を埋められます。そのため、高コストのモデルを標準化する前に、自分の評価セットでこの実験を実行してください。結果はタスクによって異なるため、他者の数値はあなたにとって大きな意味を持ちません。

予算を確定する前に、自分の数値を確認する

  • すべての応答で usage を読み取り、output_tokens_details.thinking_tokens は表示出力とは別に記録します。確認できない推論が、予想外の費用項目になります。
  • デフォルトを受け入れず、effort を明示的に設定します。プロンプトキャッシュに依存する会話では、その値を会話中一定に保ちます。
  • まず安定したプレフィックスをキャッシュブレークポイントの後ろに配置します。入力料金の 10 分の 1 でキャッシュを読み取れるため、多くの場合、モデルのダウングレードより大きな節約になります。
  • すぐに回答する必要がない処理は、Batch API に移します。
  • 代替案の料金を正確に見積もります。自分のワークロードで Claude と ChatGPT API の料金を比較することは、長期契約を結ぶ前に半日をかける価値があります。

ワークロードが自分のサーバー上で動作するエージェントの場合、最も重要な制御はモデルの選択以外にあります。VPS でエージェントのコストを管理するでは、暴走するセッションを止めるループ回数の制限と支出上限を説明し、Claude Code が実際にトークンを消費する場所では、使用状況ダッシュボードに表示される数値の意味を説明します。

FAQ

Claude Fable 5 は 100 万トークンあたりいくらですか?

Claude API では、Anthropic の料金ページを 2026 年 8 月 3 日に確認した時点で、Claude Fable 5 の料金は入力 100 万トークンあたり $10、出力 100 万トークンあたり $50 です。キャッシュ読み取りは 100 万トークンあたり $1 で、通常の入力料金の 10 分の 1 です。Batch API では入力と出力の両方が 50% 割引になり、非同期処理では 100 万トークンあたりそれぞれ $5$25 です。inference_geo パラメーターを使用して推論を米国内に限定すると、すべての料金区分に 1.1 倍の乗数が適用されます。

Claude Pro のサブスクリプションに Claude Fable 5 は含まれますか?

Anthropic の Claude Fable のページでは、このモデルは Pro、Max、Team、Enterprise のユーザーが利用できると記載されています。無料プランについては記載されていません。含まれる利用枠は無制限ではありません。プランによっては週間利用上限の一部として Fable を利用でき、別のプランでは利用クレジットを介して利用できます。この扱いは 2026 年 7 月中に複数回変更されました。利用を決める当日に、Anthropic の料金ページにあるプラン比較表の Fable の行を確認してください。記事に掲載された数値だけを信用しないでください。含まれる利用枠を使い切ると、それ以降の利用には API 料金が課金されます。

Claude Fable 5 の請求額が、表示される出力から想定した額より高いのはなぜですか?

Claude Fable 5 では Adaptive thinking が常に有効です。thinking tokens は output tokens として課金されますが、推論の生データは返されません。thinking.display がデフォルトの omitted の場合、thinking フィールドは空に見えますが、その背後で生成されたすべての推論トークンに対して課金されます。応答内の usage.output_tokens_details.thinking_tokens を確認すると内訳が分かります。ストリーミング時は、最後の message_delta イベントでのみ送信される点に注意してください。推論と回答の比率がタスクに必要な水準を超えている場合は、effort のレベルを下げてください。

Claude Fable 5 と Claude Opus 5 のどちらを使うべきですか?

Claude Opus 5 はトークン単価が半額で、信頼できる知識カットオフもより新しいです。Fable 5 の 2026 年 1 月に対して、Opus 5 は 2026 年 5 月です。まず Opus 5 で試し、そこでタスクに失敗した場合、または誤答による損失が価格差を上回る場合に Fable 5 へ切り替えてください。1 つの誤った分岐で数時間の修正作業が発生する長時間のエージェント処理や、すべてのリクエストに継続して追加料金を支払うのではなく、1 回の請求に割増料金をまとめられる単発処理では、Fable 5 が適しています。

#claude#fable#model-selection#pricing#tokens