SSD Nodes Learn Hosting plans →
ガイド Matt Connor著者 Matt Connor ・更新日 2026-09-07

Claude Fable 5の料金は?コストと使い分けを解説

Claude Fable 5の料金は入力100万トークンあたり10ドル、出力50ドルです。他モデルとの価格比較や、プロンプトキャッシングを活用したコスト削減方法、9月以降の価格改定による影響まで詳しく解説します。

Claude Fable 5 の料金はいくらですか?

Claude Fable 5 の Claude API における料金は、入力トークン 100 万あたり $10、出力トークン 100 万あたり $50 です。これらは 2026 年 8 月 3 日時点の料金ページに記載されている Anthropic の公開価格です。API モデル ID は claude-fable-5 です。本モデルは 2026 年 6 月 9 日より、Claude API、Amazon Bedrock、AWS 上の Claude Platform、Google Cloud、および Microsoft Foundry にて一般提供が開始されました。

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

この料金体系は段階的になっています。Fable 5 の価格は Claude Opus 5 の 2 倍、現行の Claude Sonnet 5 の 5 倍、Claude Haiku 4.5 の 10 倍に設定されています。どのモデルも出力料金が入力料金のちょうど 5 倍に設定されているため、請求の両面で比率は一定です。したがって、ジョブにおける入力トークンと出力トークンの比率がわかれば、乗算によって他のモデルの価格に換算できます。

日付によって計算が変わる点に注意してください。Sonnet 5 は 2026 年 8 月 31 日まで、入力トークン 100 万あたり $2、出力トークン 100 万あたり $10 という導入価格で提供されています。2026 年 9 月 1 日以降は、入力トークン 100 万あたり $3、出力トークン 100 万あたり $15 となります。Fable 5 の価格に変更はないため、同日以降、両者の価格差は 5 倍から 3 倍強へと縮小します。秋以降の予算を策定する場合は、9 月以降の Sonnet の数値を使用してください。

割引と、逆方向に作用する1つの倍率

プロンプトキャッシングは最大のコスト削減手段です。キャッシュ読み取りのコストは基本入力価格の10分の1であり、Fable 5では100万トークンあたり $1 です。キャッシュへの書き込みは通常の入力トークンよりも高価で、5分キャッシュの場合は基本価格の1.25倍、1時間キャッシュの場合は2倍となります。5分キャッシュは1回の読み取りで元が取れ、1時間キャッシュは2回の読み取りで元が取れます。この計算こそが、すべてに適用する前に プロンプトキャッシングの損益分岐点を算出する べきであるという議論のすべてです。

Batch APIは両方のコストを50%削減するため、バッチ処理されたFable 5の作業コストは100万トークンあたり $5 および $25 となります。バッチリクエストは非同期であるため、これは即時の回答を必要としない作業にのみ有効です。2つの割引は累積されるため、キャッシュを利用したバッチジョブは両方の軸で安価になります。

100万トークンのコンテキストウィンドウは、Claude 4.6以降のモデルでは標準料金に含まれています。長大なコンテキストに対する追加料金はないため、90万トークンのリクエストも9000トークンのリクエストと同じトークン単価で請求されます。

請求額を増加させる倍率はデータレジデンシーです。inference_geo: "us"を設定して推論を米国内に限定すると、キャッシュの読み取りおよび書き込みを含むすべてのトークンカテゴリに1.1倍の倍率が適用されます。契約上の義務がない限り、デフォルトのグローバルルーティングのままにしてください。

このモデルには特有の請求ルールが1つあります。Fable 5にはリクエストを拒否できる安全分類機能が搭載されています。これが発生した場合、Messages APIはエラーではなく成功を示すHTTP 200レスポンスとしてstop_reason: "refusal"を返します。また、出力が生成される前に拒否されたリクエストについては課金されません。同じプロンプトを別のClaudeモデルで再試行した場合、フォールバッククレジットによって切り替え時のプロンプトキャッシュコストが払い戻されるため、同じキャッシュを温めるために二重に支払う必要はありません。

どのプランに Claude Fable 5 が含まれていますか?

2026年8月3日現在、Anthropic の Claude Fable ページによると、このモデルは Pro、Max、Team、および Enterprise ユーザーが利用可能です。無料プランについては言及されていません。Pro はこのリストの中で最も安価なシートであるため、Pro の料金と利用制限の境界線が Fable を利用するためのサブスクリプションの最低ラインとなります。Fable へのアクセスがアップグレードの主な理由である場合は、まず Pro シートが自身の利用用途に対して支払う価値があるかを検討してください。Fable の利用枠が少ない場合、それ単体ではサブスクリプションの根拠として不十分だからです。開発者向けには、Claude API および前述のクラウドマーケットプレイスを通じて一般提供されています。このルートには無料枠がないため、サインアップ時に Anthropic が付与する少額のクレジットが課金開始前のすべてとなります。

プランで利用可能であることと、無制限に含まれていることは同義ではありません。また、サブスクリプションは API のような従量課金制ではありません。Pro シートには公開されたトークン制限が存在しないため、代わりに一定期間のメッセージ数で利用量をカウントします。そのため、プランの内容を上記の「100万トークンあたりの料金」に単純換算することはできません。Anthropic の料金ページにあるプラン比較表では、Fable の利用は一部のシートで週間の利用制限枠の一部として、また他のシートでは利用クレジットとして制限されており、この仕組みは2026年7月中に複数回変更されました。Fable 5 の再展開に関する Anthropic の声明では、2026年7月7日まで Pro、Max、Team、および一部の Enterprise プランにおいて週間の利用制限の最大50%までモデルを利用可能とし、それ以降は利用クレジット制としました。7月中の報道では、さらなる延長やシートタイプによる差異が報告されています。

したがって、本ページにはプランごとの制限値を記載しません。同月中に公開された数値は2週間も維持されなかったため、古い数値を記載することは無記載よりも悪影響を及ぼすからです。利用を決定した当日にプラン比較表の Fable の行を確認し、ニュース記事の数値は古いものとして扱ってください。Fable アクセスのためにシートを購入し、利用枠が表から期待したよりも少なかった場合でも、次回の更新前にプランをダウングレードすることで、すでに支払い済みの月分はそのまま利用可能です。

安定しているのは API 料金です。どのルートであっても、含まれている利用枠を使い切った後は、上記の表の価格で Fable 5 の利用料金が発生します。Enterprise プランではこの構造が明確です。Enterprise シート料金はアクセス権を購入するものであり、トークン自体は API 料金で別途課金されるためです。そのため、どちらのルートであっても料金表を基準に計画を立てるのが正解であり、これは他の Claude モデルで API 課金とサブスクリプションを比較する際に到達する結論と同じです。まだプランを選択していない場合は、自身の利用状況に合う Claude プランから検討を始めてください。そのシートを Fable への入り口としてだけでなく、日常的なアシスタントとして使用する予定であれば、契約前に Claude プランと ChatGPT の料金比較を確認することをお勧めします。

請求額が価格比率から想定されるよりも高くなる理由

Fable 5 の利用料金が単純な価格比較から想定されるよりも高くなる要因には、2 つの文書化されたメカニズムがあります。

1 つ目はトークナイザーです。Fable 5 は Claude Opus 4.7 で導入されたトークナイザーを使用します。Opus 4.7 より前にリリースされたモデルと比較すると、同じテキストでも約 30% 多くトークンが生成されます。増加率はコンテンツによって異なります。Haiku 4.5 はこのトークナイザーより前のモデルであるため、価格表上の 10 倍という差は、同じテキストブロックを入力した場合、実際には 13 倍近くになります。Sonnet 5 は新しいトークナイザーを使用しているため、Fable と Sonnet の比較はトークン単位で公平ですが、Fable と Haiku の比較はそうではありません。

2 つ目は思考プロセスです。Fable 5 では適応型思考が常に有効であり、thinking: {"type": "disabled"} はサポートされていません。思考トークンは出力トークンとして課金され、フル出力レートが適用されます。このモデルでは生の思考プロセス(chain of thought)は返されず、thinking.display はデフォルトで "omitted" となるため、目に見える回答が短くても、課金対象の出力カウントは大きくなる可能性があります。Anthropic のドキュメントには、「課金対象の出力トークン数は、レスポンス内の目に見えるトークン数とは一致しない」と明記されています。

推測するのではなく、内訳を確認してください。usage.output_tokens_details.thinking_tokens フィールドには、推論に費やされた課金対象の出力トークン数が報告されます。

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

Anthropic の思考プロセスに関するドキュメントから引用したこの例では、課金対象の出力トークン 348 個のうち 312 個が、ユーザーには表示されない推論分です。ストリーミング時、この内訳は最後の message_delta イベントでのみ到着するため、最後のテキストチャンクで読み取りを停止するクライアントでは記録されません。

制御には effort を使用します。設定値は output_config.effort で、レベルには low、medium、high(デフォルト)、xhigh、max があります。

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

このモデルに関する Anthropic のガイダンスでは、まず high から開始し、最も能力が求められる作業でのみ xhigh に引き上げ、日常的な作業では medium または low に下げることを推奨しています。これは、Fable 5 での低負荷な処理が、旧モデルでの xhigh を上回ることが多いためです。これには 2 つの注意点があります。リクエスト間で負荷設定を変更するとプロンプトキャッシュが無効になります。これは、解決された負荷値がプロンプトにレンダリングされるためです。そのため、ワークロードごとにレベルを選択し、固定してください。また、max_tokens は思考と回答テキストを合わせた合計出力に対するハードキャップです。思考を含まない回答用に設定されたキャップでは、回答が切り捨てられます。stop_reason: "max_tokens" が表示された場合は、キャップを引き上げるか、負荷設定を下げてください。

トークン単価ではなく、タスク完了あたりのコスト

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

3 行のデータは計算上の数値であり、ベンチマークではありません。料金は公開されているものを使用しています。トークン量はあくまで想定値ですので、ご自身の利用データに基づいた数値に置き換えてください。中間の行のようなコーディングセッションの場合、Fable 5 では $5.00、Sonnet 5 では $1.00 のコストがかかります。長時間の実行では、Fable 5 が $40.00、Sonnet 5 が $8.00 となります。最後の行にある Haiku の列は単なる計算値です。Haiku 4.5 のコンテキストウィンドウは 200k トークンであるため、そのジョブを処理することはできません。

意思決定において、トークン単価を指標にするのは誤りです。タスク完了あたりのコストとは、試行あたりのコストに試行回数を掛け合わせたものです。現在の料金体系では、Fable 5 の 1 回の試行コストは Sonnet 5 の 5 回分に相当します。そのため、再試行回数だけを理由にアップグレードを正当化することはほぼ不可能です。Sonnet が 5 回中 4 回以上失敗しない限り、安価なモデルの方がトークンコストの面で有利になることはありません。

アップグレードを正当化できるのは、トークンの請求書には現れない要素です。表にある 2 つの長時間実行のコスト差は、多くの市場におけるエンジニアの 1 時間分の人件費よりも小さいものです。高価なモデルによってレビュー時間が 1 時間短縮されたり、後から修正が必要になるような不適切な移行を 1 回回避できたりすれば、請求書には現れない形でコストはすでに回収できています。比較は「承認された結果あたりの金額」で行い、合計コストには自身の作業時間も含めてください。100 万トークンで実際に何ができるかを知ることで、この見積もりはより現実的なものになります。

Claude Fable 5 がコストに見合う3つの業務

誤った判断が大きな損失を招く、長時間の自律エージェント実行。 Fable 5 は数時間に及ぶ作業向けに設計されています。1M トークンのコンテキストウィンドウ、1リクエストあたり最大 128k トークンの出力、そして数百万トークンの予算を要する30分以上のタスクを想定した xhigh の処理能力を備えています。ステップ 40 でエージェントが誤った分岐に進み、ステップ 300 になるまで誰も気づかないような事態が発生した場合の事後処理コストと比較してください。

大規模なコードベースに対する一度限りの移行や監査。 単発の作業にはコストを分散させるボリュームがないため、トークン単価のプレミアムがそのまま請求額に反映されますが、ジョブ全体が1つのコンテキストウィンドウに収まる可能性があります。非同期実行が可能な場合は、Batch API を利用することで出力トークン 100 万あたり $25 までコストを半減できます。

安価なモデルがすでに2回失敗したタスク。 2回の失敗とデバッグに費やす時間は、上記の表にあるボリュームでの Fable による1回の試行よりも高コストです。上位モデルへの切り替えはコスト効率の良い選択であり、それがモデルラダーの役割です。もし一般的なモデル階層の選択で迷っている場合は、Claude モデル階層の能力比較がこのページとは異なる視点での回答を提供します。

Sonnet 5 または Haiku 4.5 が妥当な選択となる3つの業務

大量の分類および抽出作業。 これらの業務はスループットと単価で評価されます。品質の要求水準が低く、安価なモデルで十分に到達可能な場合、Haiku 4.5 で正確に処理できるタスクに対して Fable 5 を使用しても、コストに見合う測定可能な利点は得られません。

レイテンシが製品価値に直結するインタラクティブな作業。 Anthropic のモデル比較表では、Fable 5 のレイテンシはより低速であり、思考プロセスを無効化することもできません。チャットボックスやエディタの補完機能において、ユーザーは品質よりも先に待ち時間を認識するため、高性能なモデルを使用するとかえって操作感が低下します。

2026年1月以降のイベントに依存するあらゆる作業。 Fable 5 の信頼できる知識カットオフは 2026年1月です。一方、Opus 5 は 2026年5月です。高価なモデルの方が知識が古いため、検索ツールや取得ツールを併用しない限り、最新性が求められる質問に対して古い知識のために倍のコストを支払うことになります。

コストとは別に、制約事項が1つ存在します。Fable 5 は「対象モデル (Covered Model)」に指定されているため、30日間のデータ保持が適用され、データ保持ゼロのオプションは利用できません。契約上データ保持ゼロが必須である場合、価格や割引に関係なく Fable 5 は選択肢から除外されます。

fable-method リポジトリが示すものと示さないもの

実務家たちは、Fable 5 のアプローチを安価なモデルでも実行可能なスキルへと昇華させたリポジトリを公開しています。fable-method リポジトリでは、思考スキル、オーケストレーションループ、そしてエージェント自身の報告を読み取るのではなく、主張されたチェックをすべて再実行する敵対的検証者が解説されています。README には「これはコミュニティによる抽出物であり、Anthropic の成果物ではない」と明記されています。

これをその通りのものとして扱ってください。これは人々がどのようにモデルを操作しているかを示す証拠であり、モデルの仕組みを解説したドキュメントではありません。リポジトリ内の内容は Anthropic によって検証されたものではなく、表現の異なるほぼ同一のフォークが複数存在します。これは仕様書ではなく、伝承(folklore)から予想される通りの状況です。

コスト判断において注目すべきシグナルは、人々がコピーする価値があると考えた部分が「手順」であるという点です。タスクを分類し、完了を証明するチェック項目を定義し、判断を下す前に証拠を収集し、要約を読むのではなく観察によって検証する。明示的なチェックリストと検証ステップを与えられた安価なモデルは、性能差の一部を埋めることができます。高価なモデルに標準化する前に、独自の評価セットでこの実験を行ってください。結果はタスクに依存するため、他者の数値はあなたにとってほとんど価値がありません。

予算を確定する前に自身の数値を検証する

  • すべての応答で usage を読み取り、output_tokens_details.thinking_tokens を可視出力とは別にログに記録してください。目に見えない推論プロセスこそが、予期せぬコスト増大の原因となります。
  • デフォルト値を受け入れるのではなく、effort を明示的に設定し、プロンプトキャッシュを利用する会話内ではその値を固定してください。
  • 安定したプレフィックスをキャッシュブレークポイントの前に配置してください。ベース入力価格の10分の1でキャッシュを読み取ることは、モデルのダウングレードよりも大きな節約効果があります。
  • 即時の回答を必要としない処理は、すべて Batch API に移行してください。
  • 代替案の価格を正当に評価してください。Claude と ChatGPT の API 料金比較を自身のワークロードで実施することは、長期契約を結ぶ前の午後を費やす価値があります。

ワークロードが自身のサーバーで実行されるエージェントである場合、最も重要な制御はモデルの選択外に存在します。VPS 上でのエージェントコスト管理では、暴走したセッションを停止するためのループ制限と支出上限について解説しており、Claude Code が実際にトークンを消費する箇所では、利用状況ダッシュボードに表示される数値の意味を説明しています。

FAQ

Claude Fable 5 の 100 万トークンあたりの料金はいくらですか?

Claude Fable 5 の料金は、2026 年 8 月 3 日時点の Anthropic の価格ページによると、Claude API において入力トークン 100 万あたり $10、出力トークン 100 万あたり $50 です。キャッシュ読み取りはトークン 100 万あたり $1 であり、基本入力料金の 10 分の 1 です。Batch API を利用すると両方の料金が 50% 割引となり、非同期処理ではトークン 100 万あたり $5 および $25 となります。inference_geo パラメータを使用して推論を米国内に限定する場合、すべてのカテゴリに 1.1 倍の係数が適用されます。

Claude Fable 5 は Claude Pro サブスクリプションに含まれていますか?

Anthropic の Claude Fable ページでは、本モデルは Pro、Max、Team、Enterprise の各ユーザーが利用可能とされており、無料プランについては記載がありません。含まれているアクセス権は無制限ではありません。一部のシートでは週ごとの利用制限の一部として Fable が提供され、他のシートでは利用クレジットを通じて提供されます。この取り扱いは 2026 年 7 月中に複数回変更されました。記事内の数値を鵜呑みにせず、利用を決定する当日に Anthropic の価格ページにあるプラン比較表で Fable の行を確認してください。含まれている許容量を使い切った後は、API 料金に基づいて課金されます。

Claude Fable 5 の請求額が、目に見える出力から想定される額より高いのはなぜですか?

Claude Fable 5 では適応的思考(Adaptive thinking)が常に有効であり、思考トークンは出力トークンとして課金されます。また、思考の生プロセスは返されません。thinking.display がデフォルトの omitted に設定されている場合、思考フィールドは空に見えますが、その背後にあるすべての推論トークンに対して料金が発生しています。レスポンス内の usage.output_tokens_details.thinking_tokens を読み取ると内訳を確認できます。ストリーミング時には、最終的な message_delta イベントでのみこの情報が届く点に注意してください。推論と回答の比率がタスクの必要性を上回っている場合は、effort レベルを下げてください。

Claude Fable 5 と Claude Opus 5 のどちらを使うべきですか?

Claude Opus 5 はトークンあたりの料金が半分であり、信頼できる知識のカットオフ時期も Fable 5 の 2026 年 1 月に対して 2026 年 5 月と新しくなっています。まずは Opus 5 から開始し、そこでタスクが失敗する場合や、誤った回答による損失が価格差を上回る場合にアップグレードしてください。Fable 5 は、1 つの誤った分岐が数時間の修正作業を招くような長期的なエージェント作業や、一度限りのジョブで、すべてのリクエストに永続的にプレミアムが加算されるよりも単発の請求で済ませたい場合に適しています。

#claude#fable#model-selection#pricing#tokens