如何估算自己的 Claude 帳單與每月費用
用一週實際使用量計算自己的 Claude 月費:換算輸入與輸出 token,再分別套用 Pro 和 API 費率,納入長對話歷史記錄。
Claude 帳單的決定因素
Claude 帳單只有一個乘法:您傳送與接收的 token 數量,乘以這些 token 的價格。token 是一段文字;1 個 token 約等於 4 個英文字元,或約 3/4 個單字。發票上的每一行費用都來自這個數量。
算式主要受 2 個事實影響。目前所有 Claude model 的輸出 token 費用都是輸入 token 的 5 倍,因此回答長度對帳單的影響大於問題長度。此外,對話每一輪都會重新傳送完整歷史記錄,因為 Messages API 不會在請求之間儲存任何內容:每次傳送訊息時,您的 client 都會再次傳送整個對話串。長對話的費用遠高於您在畫面上看到的文字量。
這個方法分成 3 個步驟。步驟 1:測量您實際使用情況中的一般週。步驟 2:將該週換算成 token。步驟 3:以不只 1 種費率計算同一個月的費用。使用您自己的數字執行後,最後得到的是適用於您帳戶的金額,而不是價格表。
步驟 1:測量一週的實際使用量
不要憑記憶估算。記憶會偏向一個方向:你會記得自己輸入的問題,卻忘記隨問題一起傳送的歷史內容。測量一個普通工作週,並記下四個數字。
- 每個工作日開始的對話數。
- 一般對話中的回合數。一個回合包含你的訊息和一則回覆。
- 一般回覆的長度,以字數計算。閱讀 3 則實際回覆並取平均值。
- 附加的文件和圖片,以及每個檔案的大小。
如果你使用 API 或 coding agent,確切的數量已經存在,因此請使用這些數量,不要自行計算字數。每個 Messages API 回應都包含一個 usage 物件:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0
}
}記錄這四個欄位一週後,測量步驟就完成了。在 Claude Code 中,/usage 會列印目前工作階段的相同總數,並顯示 Total cost 行;CLI 會根據按牌價計算的 token 數,在本機計算這一行。這一行只是估算值。Claude Console 中 platform.claude.com/usage 的 Usage 頁面才是與發票相符的紀錄,而 追蹤 Claude Code 長期支出的工具 讀取的也是你在此記錄的相同 token 數。
對於尚未執行的工作,請在定價前先計算。token counting endpoint 可免費呼叫,並使用與實際訊息相同的 request body。
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'回應只有一個數字。對該請求而言,數字是 {"input_tokens": 14}。請以計畫使用的模型進行計算,因為 Claude Opus 4.7 及後續版本的模型使用較新的 tokenizer,同一段文字在這些模型上的計數約高出 30%。使用較舊模型取得的計數,會使帳單大約低估相同比例。
第 2 步:將一週換算成 token
以下是一個完整計算到本頁結尾的工作週範例。閱讀時,請將每個數字替換成你的數字。5 個工作日每天進行 8 次對話,共 40 次對話。每次對話有 9 個回合。你通常每則訊息約 110 個字,等於 150 個 token。對方通常每次回覆約 450 個字,等於 600 個 token。一週附加 5 份文件,每份約 6,000 個字,因此每份約 8,000 個 token。
單次對話的可見文字量不大:9 則訊息加上 9 則回覆,共 6,750 個 token。但計費輸入量並不小,因為第 2 回合會帶入第 1 回合,第 3 回合會帶入第 1 與第 2 回合,之後直到對話串結束都依此類推。
The data behind this chart
[
{
"turn": 1,
"input_tokens": "150",
"cumulative_input_tokens": "150"
},
{
"turn": 2,
"input_tokens": "900",
"cumulative_input_tokens": "1,050"
},
{
"turn": 3,
"input_tokens": "1,650",
"cumulative_input_tokens": "2,700"
},
{
"turn": 4,
"input_tokens": "2,400",
"cumulative_input_tokens": "5,100"
},
{
"turn": 5,
"input_tokens": "3,150",
"cumulative_input_tokens": "8,250"
},
{
"turn": 6,
"input_tokens": "3,900",
"cumulative_input_tokens": "12,150"
},
{
"turn": 7,
"input_tokens": "4,650",
"cumulative_input_tokens": "16,800"
},
{
"turn": 8,
"input_tokens": "5,400",
"cumulative_input_tokens": "22,200"
},
{
"turn": 9,
"input_tokens": "6,150",
"cumulative_input_tokens": "28,350"
}
]第 1 回合會計費 150 個輸入 token。第 9 回合會計費 6,150 個輸入 token,即使訊息長度完全相同,因為它會帶入先前的所有內容。整次對話共計費 28,350 個輸入 token,約為對話串現有文字量的 4 倍。輸入量的增長速度高於回合數:回合數加倍時,輸入成本約增加至 4 倍。因此,維持工作上下文精簡不只是品質決策,也是成本決策。
附件遵循相同規則,也是估算最容易出錯的地方。若在 9 回合對話的第 1 回合附加一份文件,該文件會傳送 9 次,因此 8,000 個 PDF(portable document format)token 會變成 72,000 個計費輸入 token。附加相同檔案,並在 2 個回合內取得回覆,接著開始新的對話,成本則為 16,000 個 token。
將一週的數字乘以 4,得到一個工作月的數字。
The data behind this chart
[
{
"label": "Conversation text",
"input_tokens": "4,536,000",
"output_tokens": "864,000"
},
{
"label": "Attached documents",
"input_tokens": "1,440,000",
"output_tokens": "0"
},
{
"label": "Month total",
"input_tokens": "5,976,000",
"output_tokens": "864,000"
}
]一個月共計 5,976,000 個輸入 token,以及 864,000 個輸出 token。請查看輸入量的來源。1,440,000 個輸入 token 來自 5 份反覆傳送的文件,約占 5 份文件輸入費用的四分之一。如果你執行的是 coding agent,而不是進行聊天,相同的計算方式仍然適用;此外,每次請求還會加入 agent harness 在你輸入任何內容前傳送的工具定義與 system prompt。
第 3 步:依 API 費率計算該月份
費率以每百萬個 token 計算。以下資料於 2026 年 9 月 4 日確認,但價格會變動,因此在採用任何版本的數據前,包括本頁內容,請先向 Anthropic 查閱目前的價格。
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5,
"cache_read_usd": "0.10"
},
{
"label": "Sonnet 5",
"input_usd": 2,
"output_usd": 10,
"cache_read_usd": "0.20"
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25,
"cache_read_usd": "0.50"
}
]三種情況的輸出量都正好是輸入量的五倍,且快取讀取費用是輸入價格的十分之一。這個比例正是 輸入與輸出 token 應在估算中分開列出 的原因。換算成百萬個 token 後,計算只需進行一次除法。這也是 值得學會以百萬個 token 為計算單位 的原因:本月份在 Sonnet 5 上有 5.976 百萬個輸入 token,每個 token 的價格為 2 美元;輸出 token 則有 0.864 百萬個,每個 token 的價格為 10 美元。
The data behind this chart
[
{
"label": "Input, no caching",
"cost_usd": "11.95"
},
{
"label": "Input, with caching",
"cost_usd": "3.83"
},
{
"label": "Output",
"cost_usd": "8.64"
}
]未使用快取時,輸入費用為 $11.95,輸出費用為 $8.64。輸出約占 token 總量的八分之一,但約占總費用的五分之二。
Prompt caching 會改變輸入項目,但不會影響輸出項目。快取寫入費用是輸入價格的 1.25 倍,保存時間為五分鐘。快取讀取費用是輸入價格的 0.1 倍。在此工作負載中,每月約有五分之一的輸入 token 是首次傳送的新文字,其餘則是重複讀取的相同歷史內容,因此輸入費用降至 $3.83。這項節省的前提是每次互動都在快取有效期間內完成,且重複的前綴足夠長,確實符合快取條件,因為低於可快取最小長度的 prompt 永遠不會儲存。快取的損益平衡點 是在五分鐘有效期間內進行一次快取讀取,因此持續中的對話幾乎會立即達到這個點。
訂閱方案何時不再是較便宜的選項
The data behind this chart
[
{
"label": "Claude Pro subscription",
"cost_usd": "20.00"
},
{
"label": "API, Sonnet 5",
"cost_usd": "20.59"
},
{
"label": "API, Sonnet 5 with caching",
"cost_usd": "12.47"
},
{
"label": "API, Opus 5",
"cost_usd": "51.48"
},
{
"label": "API, Haiku 4.5",
"cost_usd": "10.30"
}
]Claude Pro 按月計費時每月為 $20.00,或一次支付 $200 使用 1 年,換算後每月為 $17。Max 每月起價為 $100,完整方案與價格清單列出更高的方案級別。以上是截至 2026 年 9 月公布的價格。
本次計算的每月費用,若依 Sonnet 5 的費率計算,為 $20.59,與 Pro 相差不到 $1。這就是此工作負載的交叉點。將相同工作改用 Opus 5,費用為 $51.48,因此訂閱方案反而是較便宜的購買方式。啟用快取後,API 端費用降至 $12.47。改用 Haiku 4.5 執行時,費用為 $10.30,相同工作量約為訂閱價格的一半。
請仔細解讀這項比較,因為它只比較金額,沒有比較其他因素。訂閱方案不是購買固定數量的 token,Anthropic 也未以 token 公布方案限制,因此本頁的任何計算都無法告訴你每週使用量是否符合 Pro 的限制。這些計算能告訴你的是,依牌價計算,你的使用量值多少;這是比較兩者最客觀的方式。方案限制實際上如何計算是另一個問題,而API 計費與訂閱方案的完整比較則涵蓋價格以外的因素,例如高使用量月份由哪一方承擔。
一項結構性差異會決定大多數實際情況。訂閱方案的上限是使用量限制,因此高使用量月份與低使用量月份的費用相同,最壞的情況只是等待限制重設。API key 的上限則由信用卡決定,因此代理程式若陷入迴圈,會為消耗的每個 token 計費。在讓任何工作持續無人管理地執行前,請先在 Console 設定 workspace 支出上限。
改變答案的 4 個關鍵因素
- 模型選擇。 同一個月,在 Opus 5 上的費用是 $51.48,在 Haiku 4.5 上則是 $10.30,相差 5 倍,因為輸入、輸出與快取的費率都會一起變動。將簡單工作交給較小的模型,是你能採取的單一最大調整。
- 縮短對話串。 3 個分開的 3 輪對話,各自計費 2,700 個輸入 token;若以涵蓋相同內容的單一 9 輪對話處理,則為 28,350 個輸入 token。主題變更時,請開始新的對話。在 Claude Code 中,
/clear也能達成相同目的。 - 快取。 它讓這項工作負載的輸入量減少約 2/3,而且啟用不需費用。只要相同的前綴在快取有效期間內被讀取超過 1 次,就能發揮效益。
- 批次處理。 Batch API 會將可延後工作的輸入與輸出費用都降低 50%,且可與快取疊加使用。它以非同步方式執行,因此不適用於互動式聊天,只適用於夜間分類待處理資料等大量工作。
另外還有 2 個容易忽略、但會影響費用的因素。延伸思考會按照輸出 token 計費,因此較高的努力程度會增加帳單中費用最高的項目。程式碼代理程式使用 token 的方式,也會讓只量測聊天用量的人感到意外;Claude Code token 實際使用方式的逐輪拆解對此有詳細說明。取得自己的數值後,真正能降低 Claude 費用的做法就應從相同的量測結果開始。
如需與其他人的數據交叉檢查:Anthropic 報告指出,在企業部署中,Claude Code 的費用約為每位開發人員每個活躍日 $13,每位開發人員每月 $150 至 $250;90% 的使用者每個活躍日的費用低於 $30。這些是高強度程式開發使用情境的公開平均值,不是對你帳戶的預測。你自行量測的一週數據,比任何公開平均值都更具參考價值;這正是進行量測的目的。
若以美元以外的貨幣付款
方案價格以美元計價。銀行會在扣款當天依自身匯率進行換算。在美國境外發行的信用卡,還可能額外收取跨境手續費。因此,帳單金額不會與標示價格完全一致。根據居住地區的不同,結帳時可能會加收當地銷售稅或 VAT(加值型營業稅)。請在美元金額之外預留少量差額,不要只按照精確金額編列預算。如果某個月份的匯率發生變動,也請再次確認實際費用。
服務是否可用與價格是兩個不同的問題。Claude 和 Claude API 僅在特定國家與地區提供服務,而且支援清單可能變更,因此請直接查閱來源:支援的國家與地區。
FAQ
一則訊息包含多少 tokens?
英文每個 token 約對應 4 個字元,或 3/4 個單字,因此 450 個單字的回覆約為 600 tokens。這個估算足以用於預算規劃。若要取得精確數值,請將 request body 傳送至免費的 count_tokens endpoint(位於 https://api.anthropic.com/v1/messages/count_tokens),然後讀取回傳的 input_tokens 欄位。請以實際使用的模型計算,因為 Claude Opus 4.7 及後續模型對相同文字的計數,比較早的模型高出約 30 percent。
為什麼我的帳單金額高於我撰寫的文字量?
因為每一輪都會重新傳送完整對話。API 不會在 request 之間保留狀態,因此對話串的第 9 輪會連同第 1 至第 8 輪一起傳送。在上述範例中,包含 6,750 tokens 可見文字的對話,會計費 28,350 input tokens。您附加的檔案也會在同一對話串的每個後續回合重新傳送,因此一份 8,000 tokens 的文件可能產生 72,000 input tokens 的費用。
Claude API 比 Pro 訂閱便宜嗎?
這取決於您使用的模型與 context length,而不是方案。以實際計算的月份為例,Sonnet 5 的費用為 $20.59,與 $20 的 Pro 相當。同一個月使用 Opus 5 的費用為 $51.48,使用 Haiku 4.5 則為 $10.30。決定前,請用您實際測量的一週用量,以兩種方式估算費用。請注意,訂閱會限制您的使用量,而 API key 不會限制使用量,因此無人值守的自動化工作應設定在 Console 的 spend limit 之後。
Prompt caching 一定能省錢嗎?
不一定。寫入 cache 的費用是 input price 的 1.25 倍,因此寫入 cache 後不再讀取的內容,成本會高於只傳送一次。只有在 cache lifetime 內再次讀取相同前綴時,caching 才能降低成本;持續進行的對話,或持續使用固定 system prompt 的 agent,通常都符合這種情況。低於最小 cacheable length 的 prompt 完全不會儲存,因此 caching 對簡短的一次性呼叫沒有影響。