SSD Nodes Learn Hosting plans →
指南 Matt Connor作者: Matt Connor · 已更新 2026-09-05

Claude Pro 包含多少 token?額度限制機制詳解

Claude Pro 並無固定 token 配額。Anthropic 採用滾動視窗內的訊息數量限制,長對話與大型附件會加速消耗額度。本文說明為何訂閱方案無法以 token 計算,並解析對話長度如何影響您的剩餘使用次數。

Claude Pro 包含多少 token?

Claude Pro 並未提供 token 配額,截至 2026 年 9 月,Anthropic 也未曾公開相關數據。Claude 訂閱方案是以滾動時間視窗內的「訊息數量」來計算,而非從餘額中扣除 token。該視窗的長度取決於您選擇的模型、對話累積的長度,以及每次對話所包含的文字量。

這通常不是人們預期會得到的答案,因為大眾習慣將訂閱方案視為 API key 的運作模式。API key 是根據 token 數量扣除餘額,因此您可以自行計算帳單金額。然而,訂閱方案販售的是 Anthropic 設定並動態調整的「訊息上限」,由於上限是以訊息數定義,因此不存在固定的 token 數值。任何提供您具體數字的人,皆非官方資訊。

因此,請嘗試換個角度提問。什麼因素會導致我的訊息消耗量增加?這個問題才有實際的答案,且您現在就能採取行動進行優化。

為什麼訂閱方案無法以 Token 數量計價

API 根據每個請求的 Token 數量進行計費。輸入 Token 涵蓋您發送的所有內容,輸出 Token 涵蓋模型回傳的所有內容,且兩者費率不同,這就是為什麼在進行任何估算前,必須先了解 輸入與輸出 Token 的成本差異

消費者方案沒有可供消耗的餘額。Anthropic 限制了您在滾動視窗內可發送的訊息數量;該視窗從您的第一則訊息開始計算,並在固定小時數後關閉。付費方案則設有第二個更長的限制,以一週為週期進行計算。由於訊息大小並不固定,相同的訊息數量對不同使用者而言,代表的工作量差異極大。Anthropic 的說明頁面以簡短對話的近似訊息數來描述這些限制,並提醒使用者長對話與大型附件會更快消耗配額。這項警告即是全部的說明,而其背後的運作機制幾乎從未被詳細解釋。

為何第 20 次對話的成本遠高於第 1 次

模型在請求之間不會保留記憶。它是無狀態的,因此每次對話都會重新發送整個對話內容:系統提示詞、您之前寫的每一則訊息、Claude 之前的每一則回覆,以及您附加的每一個檔案。您的新問題可能只有 20 個字,但承載該問題的請求卻是整個對話紀錄。

因此,單次對話的成本會隨著對話長度線性增加。下表展示了基於一組假設的運算:系統提示詞約 1,000 個 token,您的訊息每則約 1,000 個 token,回覆每則約 1,200 個 token。這些數據僅用於說明運作機制,並非您帳戶的實際用量。

ChartInput tokens per turn as one conversation grows (illustration)
The data behind this chart
[
  {
    "label": "Turn 1",
    "sent_this_turn": "2,000",
    "cumulative_input": "2,000"
  },
  {
    "label": "Turn 5",
    "sent_this_turn": "10,800",
    "cumulative_input": "32,000"
  },
  {
    "label": "Turn 10",
    "sent_this_turn": "21,800",
    "cumulative_input": "119,000"
  },
  {
    "label": "Turn 20",
    "sent_this_turn": "43,800",
    "cumulative_input": "458,000"
  }
]

第 1 次對話發送了 2,000 個輸入 token。到了第 20 次對話,同樣簡短的問題卻發送了 43,800 個 token,是最初的 20 倍以上,而您的輸入量卻相同。在整個對話過程中,您總共發送了 458,000 個輸入 token,其中大部分是重複發送的相同文字。

若進行 20 次獨立的單次對話,其發送量僅為上述第一列的 20 倍,不會有額外負擔。問題相同,但負載卻大幅降低。附件會進一步擴大差距,因為您在第 2 次對話附加的 PDF,會在第 3 次、第 4 次以及之後的每一次對話中被重複發送,無論對話是否仍與該檔案有關。

這就是為什麼使用相同方案的兩個人,其使用體驗卻截然不同。一人將單一對話串保持開啟一整週,週三就達到上限;另一人為每個任務開啟新的對話,幾乎不會遇到限制。兩者都沒有錯,只是因為習慣不同,導致 token 的消耗量出現數量級的差異。

在 API 中,您可以透過 prompt caching 來減輕重複成本,它會儲存請求中未變更的前段內容,使後續呼叫中該部分的計費費率降低。在訂閱方案中,您無法控制快取,因此對話長度是您唯一能掌控的變數。同樣的機制也主導了程式設計對話,檔案內容與工具定義會隨每一次對話傳送,因此 保持程式設計對話的上下文簡潔 對於維持額度限制的幫助,遠大於任何設定;此外,在責怪方案限制之前,閱讀 Claude Code 對話的 token 實際去向 也非常有價值。

各方案等級的相對權益

沒有任何方案等級會公布絕對的配額。公布的數據皆為相對值,但這些相對資訊已足以作為選擇依據。免費版位於最底層,當服務需求量大時,免費容量可能會縮減。Pro 版位於其上。Max 版提供兩種規格,以 Pro 的使用量為倍數基準,分別約為 5 倍與 20 倍。Team 與 Enterprise 版則按席位計價,並設有各自的上限。

請將這些倍數視為服務意向而非合約。Anthropic 會調整上限,且不會提前公告,這也是為什麼沒有任何誠實的頁面能提供確切的 Token 數字。關於費用方面的比較,Pro 的費用與上限限制 以及 兩種 Max 等級間的差異 涵蓋了相關資訊,而 免費方案的實際允許範圍 則說明了基礎門檻。

模型選擇是疊加在方案等級之上的第二個乘數。在最大型的模型上詢問同一個問題,所消耗的額度會比最小型的模型更多,因為較大型的模型在執行時,每個 Token 的成本更高。將例行性工作從 Opus 降級至 Sonnet 或 Haiku,通常比升級方案更能延長工作時間,因此當您持續耗盡額度時,將模型與工作需求進行匹配 是首要嘗試的解決方案。

如何查看個人用量而非憑空猜測

您的帳號是唯一的權威來源,且只需點擊兩次即可查看。在 claude.ai 開啟 Settings,接著點選 Usage。它會顯示您在當前視窗內的消耗量以及該視窗的重置時間。當系統開始拒絕回覆時檢查一次,並在長對話後再檢查一次,您就能比參考任何公開數據更快掌握自己的使用模式。

在 Claude Code 中,兩個斜線指令可在終端機執行相同功能。/usage 會回報方案用量與重置時間。/context 則會拆解目前佔用 Context Window 的內容,分別列出系統提示詞、工具定義、檔案與對話紀錄。當 /context 顯示舊對話佔據過多空間時,執行 /clear 可開啟新的對話階段,單次對話成本將會降回上述圖表的第一列水準。

在 API 中,計數是精確的,您可以在發送任何請求前先進行查詢:

curl https://api.anthropic.com/v1/messages/count_tokens \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-sonnet-5",
    "messages": [{"role": "user", "content": "Summarise the attached report."}]
  }'

正常的響應只會包含一個欄位,這就是計費所依據的數值:

{"input_tokens": 14}

每個完成的請求在結束時都會回報相同的計費資訊:

{"usage": {"input_tokens": 21430, "output_tokens": 512}}

發送一個簡短問題作為新請求,接著在長對話串的末尾發送同一個問題,並比較兩者的 input_tokens 數值。兩者的差額即為您訂閱方案所計量的實際影響,並以數字形式呈現。

當任務執行中觸及限制時的處理方式

  1. 等待視窗重置。應用程式會顯示重置時間,且等待時間通常比尋找替代方案更短。若無急迫期限,這是最合適的做法。
  2. 切換至較輕量的模型。在所有方案中,較小模型的單次對話成本均較低;部分方案甚至會從獨立的額度中扣除,讓您在大型模型受限時仍能繼續工作。
  3. 開啟新的對話,僅保留下一步所需的資訊。請貼上結論而非完整對話紀錄。此舉可立即降低單次對話的 Token 消耗,且由於模型無需處理數千個已定案的討論內容,回答品質通常會提升。
  4. 將工作移至 API。API 依請求計算 Token 並按量計費,沒有等待視窗的問題,且您能在執行前後預估每次呼叫的成本。

選擇哪種方案取決於您的問題是源於「時間限制」還是「工作負載」。偶發性的超額屬於時間問題;若每週三都會遇到瓶頸,則屬於工作負載問題,此時應考慮使用 API 或升級方案,而非調整時間。任務中觸及限制時的完整檢查清單 逐步說明了復原步驟,而 滾動視窗的開啟與重置機制 則解釋了計時邏輯。若您打算轉向 API,請先進行成本評估:API 與訂閱方案針對相同工作負載的比較 以及 一百萬個 Token 的實際成本 提供了遷移前的計算參考。

FAQ

Claude Pro 包含多少 token?

Anthropic 並未公開 Pro 方案的 token 配額,截至 2026 年 9 月,並無相關數據可供引用。Pro 方案是依據滾動視窗內的訊息量進行計量,並設有以週為單位的總量上限;實際可傳送的訊息數會隨模型類型與對話長度而異。任何聲稱 Pro 方案每月有固定 token 額度的頁面皆為臆測。請開啟 claude.ai 的 Settings,接著點選 Usage,即可查看您的個人用量與重置時間。

開啟新對話會重置用量嗎?

不會。用量是針對您的帳號在整個視窗期間進行累計,因此開啟新對話並不會歸還已消耗的額度。新對話改變的是後續每一輪對話的成本。由於新對話無需重新傳送對話紀錄,因此會從上述圖表的低點開始計算,而非持續攀升。在更換主題時開啟新對話,是所有方案中最節省用量的習慣。

為什麼今天比昨天更快達到限制?

通常是因為今天的工作集中在同一個長對話串中。每一輪對話都會重新傳送整個對話紀錄以及所有附加檔案,因此即使您看到的訊息數量未變,單則訊息的成本仍會持續攀升。另一個常見原因是模型選擇:較強大的模型在每一輪對話中消耗的配額較快,因此使用最大型號模型度過一下午,會比上午使用較小模型更快達到上限。

我應該轉用 API 以獲得精確的 token 計算嗎?

若您需要數據或可預測性,建議轉用 API。API 會在每次呼叫時計算輸入與輸出的 token,並提供可在傳送前執行的 token 計算端點,且沒有等待視窗的限制。API 採 token 計費,因此高用量時的成本會高於固定訂閱費用,而低用量時則會便宜許多。在切換前,請先根據您的實際工作負載評估成本,因為答案會根據您傳送的 token 數量而有所不同。