Claude Fable 5 價格與使用建議:API 成本分析
Claude Fable 5 定價為每百萬輸入 token 10 美元,輸出 50 美元。本文解析 Prompt caching 與 Batch API 折扣對實際運算成本的影響,協助您精算秋季開發預算。
Claude Fable 5 的費用為何?
Claude Fable 5 在 Claude API 的費用為每百萬輸入 token $10,每百萬輸出 token $50。以上為 Anthropic 於 2026 年 8 月 3 日發布於定價頁面的公開牌價。其 API 模型 ID 為 claude-fable-5。該模型於 2026 年 6 月 9 日正式於 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 與 Microsoft Foundry 上線。
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]請將此視為一個階梯。Fable 5 的牌價是 Claude Opus 5 的兩倍、目前 Claude Sonnet 5 費率的五倍,以及 Claude Haiku 4.5 的十倍。帳單兩端的比例相同,因為該圖表中每個模型的輸出價格皆為其輸入費率的五倍。因此,若您已知作業的輸入與輸出 token 分配比例,即可透過乘法將一種價格轉換為另一種。
日期會影響計算方式。Sonnet 5 在 2026 年 8 月 31 日前享有推廣價,分別為每百萬 token $2 與 $10。自 2026 年 9 月 1 日起,其牌價將調整為 $3 與 $15。Fable 5 的價格維持不變,因此兩者間的價差將於當日從五倍縮小至三倍多一點。若您正在編列秋季預算,請使用後期的 Sonnet 數據。
折扣與唯一的反向乘數
Prompt caching 是最具影響力的成本優化手段。快取讀取成本僅為基礎輸入價格的十分之一,在 Fable 5 上為每百萬 token $1。寫入快取的成本高於一般輸入 token:五分鐘快取為基礎價格的 1.25 倍,一小時快取則為 2 倍。五分鐘快取在讀取一次後即可回本,一小時快取則需讀取兩次。這項計算正是 計算 prompt caching 損益平衡點 的核心依據,建議在全面啟用前先進行評估。
Batch API 提供雙向 50% 的折扣,因此批次處理 Fable 5 的成本為每百萬 token $5 與 $25。由於批次請求為非同步處理,此方案僅適用於無需即時回應的工作。兩項折扣可疊加使用,使經過快取的批次作業在輸入與輸出兩端均能大幅降低成本。
Claude 4.6 及後續模型均以標準費率提供 1M token 的 Context window。系統不收取長文本附加費,因此 900k token 的請求與 9k token 的請求適用相同的單位 token 費率。
會導致帳單增加的乘數是資料落地(data residency)。設定 inference_geo: "us" 將推論限制在美國境內,會對所有 token 類別(包含快取讀取與寫入)套用 1.1 倍的乘數。除非合約另有規定,否則請維持預設的全球路由設定。
有一項計費規則專屬於此模型。Fable 5 內建安全分類器,可能會拒絕請求。當發生此情況時,Messages API 會回傳 stop_reason: "refusal" 作為成功的 HTTP 200 回應,而非錯誤訊息;若請求在產生任何輸出前即被拒絕,則不會向您收費。若您在其他 Claude 模型上重試相同的 prompt,fallback credit 將會退還切換過程中的 prompt cache 成本,確保您無需為重複預熱相同的快取付費。
哪些方案包含 Claude Fable 5?
截至 2026 年 8 月 3 日,Anthropic 的 Claude Fable 頁面顯示該模型適用於 Pro、Max、Team 與 Enterprise 用戶。免費方案未列入其中。Pro 是該列表中價格最低的方案,因此 Pro 的費用與使用限制門檻 決定了訂閱 Fable 的最低成本。若您升級的主要目的是為了使用 Fable,請先評估 Pro 方案是否符合您的個人使用需求,因為僅為了少量的 Fable 配額而訂閱並不划算。對於開發者而言,該模型已透過 Claude API 及上述雲端市集全面開放。此途徑不提供免費層級,因此您在付費前僅能使用 Anthropic 註冊時贈送的少量額度。
可在方案中使用,不代表可無限制使用。訂閱方案的計量方式也不同於 API,因為 Pro 席位完全沒有公開的 token 配額,而是以滾動時間窗內的訊息數量計算用量。因此,方案中的任何項目都無法直接換算為上述每百萬次的數值。
Anthropic 定價頁面的方案比較表顯示,部分席位的 Fable 使用量上限取決於每週使用上限的比例,其他席位則使用用量點數。這項安排在 2026 年 7 月期間曾多次變更。Anthropic 自己針對重新部署 Fable 5 的說明指出,Pro、Max、Team 及部分 Enterprise 方案在 2026 年 7 月 7 日前,可使用該模型,額度最高為每週使用上限的 50%;該日期之後則改用用量點數。7 月剩餘期間的報導指出,使用期限進一步延長,且不同席位類型採用不同安排。
因此,本頁面不會列出各方案的具體限制。該月份發布的任何數據均未維持超過兩週,過時的數字比沒有資訊更糟。請在您決定訂閱當日,查看方案比較表中標記為 Fable 的列,並將新聞報導中的任何數字視為過時資訊。若您為了使用 Fable 而訂閱,但發現配額少於表格預期,在下次續訂前降級 不會影響您已付費的當月權益。
穩定的是 API 費率。無論透過何種途徑,一旦用盡包含的配額,後續的 Fable 5 使用量將依上述圖表中的價格計費。Enterprise 方案明確了此結構,因為 Enterprise 訂閱費僅購買存取權,Token 仍需依 API 費率計費。這使得價格表成為規劃預算時的唯一依據,這與您在 比較 API 計費與訂閱方案 其他 Claude 模型時得出的結論相同。若您尚未選擇方案,請從 哪種 Claude 方案符合您的使用量 開始評估。若該方案除了作為 Fable 的入口,還將作為您的日常助理,建議在訂閱前先查看 Claude 方案與 ChatGPT 的價格比較。
為何您的帳單金額高於價格比例的預期
有兩個已記錄的機制導致 Fable 5 的成本高於單純價格比較所顯示的結果。
第一個是 Tokenizer(分詞器)。Fable 5 使用 Claude Opus 4.7 引入的 Tokenizer。與 Opus 4.7 之前發布的模型相比,相同的文字會產生約 30% 更多的 Token,具體的增加幅度取決於內容。Haiku 4.5 早於該 Tokenizer,因此當您將同一段文字輸入兩個模型時,價格表上的十倍差距實際上會接近十三倍。Sonnet 5 使用較新的 Tokenizer,因此 Fable 與 Sonnet 的每 Token 比較是公平的,但 Fable 與 Haiku 則不然。
第二個是思考過程。Fable 5 預設開啟自適應思考(Adaptive thinking),且不支援 thinking: {"type": "disabled"}。思考過程產生的 Token 會以完整的輸出費率計費。此模型不會回傳原始的思考鏈(Chain of thought),且 thinking.display 預設為 "omitted",這意味著簡短的可見回答可能包含大量的計費輸出 Token。Anthropic 的文件明確指出:計費的輸出 Token 數量與回應中可見的 Token 數量並不相符。
請閱讀詳細分析,而非自行猜測。欄位 usage.output_tokens_details.thinking_tokens 會回報有多少計費輸出 Token 用於推理:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}在取自 Anthropic 思考文件範例中,312 個計費輸出 Token 當中有 348 個是無人可見的推理過程。當您使用串流(Streaming)時,此分析僅會在最後的 message_delta 事件中出現,因此若客戶端在讀取到最後一個文字區塊時就停止,將無法記錄此數據。
控制參數為 effort,設定值為 output_config.effort,包含 low、medium、high(預設值)、xhigh 與 max 等級。
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}Anthropic 對此模型的建議是從 high 開始,僅在對能力要求最嚴苛的工作中調升至 xhigh,並在日常工作中調降至 medium 或 low,理由是 Fable 5 在較低努力程度下的表現通常優於早期模型的 xhigh。這伴隨著兩個陷阱。在請求之間更改努力程度會使您的 Prompt cache 失效,因為解析後的努力程度值會被渲染進 Prompt 中,因此請針對每個工作負載選擇一個等級並保持固定。此外,max_tokens 是對總輸出(思考過程與回應文字總和)的硬性上限,因此若上限僅針對無思考過程的回答設定,將會導致截斷。若看到 stop_reason: "max_tokens",代表您必須提高上限或降低努力程度。
以完成任務計費,而非以 Token 計費
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]3 列中的數據為算術運算結果,並非效能基準測試。費率皆已公開,而 Token 用量僅為假設值,您應替換為實際的使用數據。以中間列的程式開發工作階段為例,使用 Fable 5 的成本為 $5.00,而 Sonnet 5 則為 $1.00。長週期任務的成本分別為 $40.00 與 $8.00。最後一列的 Haiku 欄位僅為算術推算:由於 Haiku 4.5 的 Context window 限制為 200k tokens,該模型根本無法處理此類任務。
以 Token 單價作為決策依據並不正確。完成任務的總成本應為「單次嘗試成本」乘以「嘗試次數」。以目前的費率計算,一次 Fable 5 的嘗試成本相當於五次 Sonnet 5 的嘗試,因此單憑重試次數幾乎無法證明升級的必要性。除非 Sonnet 在五次嘗試中失敗超過四次,否則低價方案在 Token 成本上並不會處於劣勢。
真正能證明升級價值的,是 Token 帳單中未顯示的隱形成本。圖表中兩者長週期任務的成本差距,在多數市場中甚至不到工程師一小時的薪資。若高階模型能節省一小時的審閱時間,或避免一次需要後續修復的錯誤遷移,其節省的隱形成本早已超過帳面差額。請以「每個被採納結果的成本」進行比較,並將您個人的時間成本納入總額。了解一百萬個 Token 的實際價值 能讓此估算更具體,而非流於抽象。
Claude Fable 5 物有所值的三種工作場景
需要長時間運行的代理程式,且錯誤代價高昂。 Fable 5 專為以小時為單位的任務設計:具備 1M token 的上下文視窗、單次請求最高 128k 的輸出 token,以及針對運行超過 30 分鐘且 token 預算達數百萬等級任務所優化的 xhigh 效能水準。請權衡運行成本與錯誤處理的代價,特別是當代理程式在第 40 步走錯方向,卻直到第 300 步才被發現時的清理成本。
針對大型程式碼庫進行的一次性遷移或審計。 一次性工作無法透過大量執行來攤提成本,因此單一 token 的溢價會直接反映在單筆帳單上,且整個工作通常能放入單一上下文視窗中。若任務可非同步執行,使用 Batch API 可將成本減半至每百萬輸出 token $25。
較低階模型已失敗兩次的任務。 兩次失敗嘗試加上您的除錯時間,其成本已高於使用一次 Fable 進行嘗試的費用(參考上方圖表中的用量)。升級模型是更經濟的選擇,這正是模型階梯(model ladder)存在的目的。若您仍在選擇不同等級的模型,Claude 模型等級間的能力比較 將能回答與本頁面不同的問題。
適合選擇 Sonnet 5 或 Haiku 4.5 的三種工作場景
高吞吐量的分類與提取任務。 此類工作的評估指標為處理量與單位成本,且品質門檻較低,低成本模型即可達成。若 Haiku 4.5 已能正確完成任務,使用價格高出 10 倍的 Fable 5 並不會帶來可量化的效益。
以延遲為核心的互動式工作。 根據 Anthropic 的模型規格表,Fable 5 的相對延遲較高,且無法關閉思考過程。在聊天視窗或編輯器自動補全功能中,使用能力較強的模型反而體驗較差,因為使用者對等待時間的感知遠比對品質的感知更為敏銳。
任何依賴 2026 年 1 月之後事件的工作。 Fable 5 的可靠知識截止日期為 2026 年 1 月,而 Opus 5 則為 2026 年 5 月。價格較高的模型反而資訊較舊,因此在處理時效性問題時,除非您額外提供搜尋或擷取工具,否則支付雙倍費用只會換來較舊的知識。
有一項限制完全與成本無關。Fable 5 採用 30 天資料保留政策,且不提供零資料保留選項,因為它被歸類為「受控模型」(Covered Model)。若您的合約要求零資料保留,無論價格為何,Fable 5 皆非選項,且任何折扣都無法改變此限制。
Fable-method 儲存庫展示了什麼,以及它們沒展示什麼
從業人員已發布多個儲存庫,將 Fable 5 的運作方式提煉為低成本模型可遵循的技能。fable-method 儲存庫 描述了一種思考技能、一個編排迴圈,以及一個對抗式驗證器,後者會重新執行每一項聲稱的檢查,而非僅讀取代理程式自身的報告。其 README 明確指出:「這是社群的提煉成果,並非 Anthropic 的產物。」
請將其視為上述內容。它是人們如何驅動模型的證據,而非模型運作方式的技術文件。其中內容未經 Anthropic 驗證,且存在多個措辭不同的近乎相同的分支,這正是民間傳說而非規格說明書會有的現象。
對於成本決策而言,值得參考的訊號在於人們認為值得複製的部分皆為程序性內容。將任務分類、命名證明任務完成的檢查項目、在決策前收集證據,然後透過觀察而非閱讀摘要來進行驗證。當低成本模型獲得明確的檢查清單與驗證步驟時,能縮小部分差距,因此請在您的評估集上執行該實驗,再決定是否標準化使用昂貴的模型。結果取決於您的任務,這就是為什麼其他人的數據對您而言參考價值有限的原因。
在提交預算前請先核對自身數據
- 閱讀每一則回應的
usage,並將output_tokens_details.thinking_tokens與可見輸出分開記錄。您未曾看見的推理過程,往往是導致預算超支的隱藏項目。 - 明確設定
effort,不要直接使用預設值,並在任何依賴 prompt caching 的對話中保持該數值恆定。 - 將穩定的前綴詞(prefix)置於快取斷點(cache breakpoint)之前。快取讀取的成本僅為基礎輸入價格的十分之一,其節省效益遠高於大多數模型降級方案。
- 將任何不需要立即回應的任務移至 Batch API 處理。
- 誠實評估替代方案的價格。在進行長期承諾前,花一個下午的時間 比較 Claude 與 ChatGPT API 定價 對於您的工作負載至關重要。
若工作負載是運行在您自有伺服器上的代理程式(agent),關鍵控制項其實在模型選擇之外。控制 VPS 上的代理程式成本 一文涵蓋了防止失控會話的迴圈限制與支出上限,而 Claude Code 實際消耗 token 的位置 則解釋了您在用量儀表板中看到的數據含義。
FAQ
Claude Fable 5 每百萬 token 的費用為何?
Claude Fable 5 在 Claude API 的定價為每百萬輸入 token $10,每百萬輸出 token $50,此數據於 2026 年 8 月 3 日查閱 Anthropic 定價頁面。快取讀取(cache read)費用為每百萬 token $1,為基礎輸入費率的十分之一。Batch API 提供 50% 的折扣,非同步作業的費用為每百萬 token $5 與 $25。若使用 inference_geo 參數將推論限制在美國境內,各項費用將乘以 1.1 倍。
Claude Pro 訂閱方案包含 Claude Fable 5 嗎?
Anthropic 的 Claude Fable 頁面顯示該模型適用於 Pro、Max、Team 與 Enterprise 用戶,並未提及免費方案。包含的存取權限並非無限。部分帳號的使用量取決於每週使用限制,部分則透過使用額度(usage credits)計算,此機制在 2026 年 7 月期間曾多次變更。請在決定當日查閱 Anthropic 定價頁面中的方案比較表,查看標記為 Fable 的列,切勿僅依賴文章中的數據。一旦用盡包含的額度,後續使用將依 API 費率計費。
為何我的 Claude Fable 5 帳單金額高於可見的輸出量?
Claude Fable 5 的自適應思考(adaptive thinking)功能預設開啟,思考過程產生的 token 會計入輸出 token 費用,且原始思考鏈(chain of thought)不會回傳。當 thinking.display 設為預設值 omitted 時,您在支付所有推理 token 費用的同時,卻看不到思考內容。請查看回應中的 usage.output_tokens_details.thinking_tokens 以了解比例,並注意在串流傳輸時,該數據僅會在最後的 message_delta 事件中出現。若推理與答案的比例高於任務需求,請降低 effort 等級。
我該使用 Claude Fable 5 還是 Claude Opus 5?
Claude Opus 5 的每 token 費用僅為前者的一半,且具備較新的可靠知識截止日期(2026 年 5 月,Fable 5 為 2026 年 1 月)。建議從 Opus 5 開始使用,若任務失敗,或錯誤答案造成的損失高於兩者價差時,再升級至 Fable 5。Fable 5 適合長期的代理(agent)作業,因為這類任務中一個錯誤分支可能導致數小時的清理工作;它也適合單次性任務,將溢價集中在單張帳單上,而非永久增加每次請求的成本。