SSD Nodes Learn Hosting plans →
指南 Matt Connor作者: Matt Connor · 已更新 2026-09-13

Claude Pro 額度怎麼用掉?長對話最耗量

Anthropic 沒有公布 Claude Pro 的 token 額度。長對話會重送完整記錄,附件、圖片、effort 等級、工具與代理程式也會消耗額度。

哪些內容會用掉 Claude Pro 的額度

Anthropic 沒有公布 Claude Pro 的 token 額度,因此沒有人能告訴你額度是多少 token。哪些內容會消耗額度則可以確認,而且更有參考價值:首先是對話長度,其次是附件與圖片,再來是思考量,最後是工具與代理程式工作。

token 是一段文字,大約相當於一個短單字或較長單字的一部分。你傳送的每個請求都會以 token 計算,方案會在背景中替你統計。Anthropic 的使用額度最佳實務頁面列出會影響計數的項目:訊息長度、檔案附件大小、目前的對話長度、Research 和網頁搜尋等工具使用情況、模型選擇、effort 等級,以及 artifact 建立。清單中的每個項目都會產生相同的影響。每個項目都會改變單一請求所包含的 token 數量。

另外兩個相鄰問題各有專頁。Pro 方案包含多少使用額度說明額度大小,以及為何額度是以工作階段而非 token 描述。達到額度上限後該怎麼辦說明如何恢復使用。本頁說明額度消耗在何處。

每則訊息都會重新傳送完整對話

這是幾乎所有人都會感到意外的運作方式。模型在不同回合之間沒有記憶。為了回答你的下一則訊息,模型會從第一個字開始,重新讀取完整對話。Anthropic 的文件明確指出:每次請求都會重新傳送完整的對話記錄。

因此,5 個字的後續訊息並不是 5 個字的請求,而是整個對話串再加上 5 個字。

這個算式值得實際算一次。假設每回合增加約 500 個 token,包含你的訊息與 Claude 的回覆。第 2 回合會傳送約 1,000 個 token;第 10 回合約 5,000 個;第 20 回合約 10,000 個,是第 2 回合成本的 10 倍,而你輸入的文字量相同。20 個回合累計會攜帶約 105,000 個 token;相較之下,將相同的 20 個問題分別放在 20 個新對話中,累計約 10,000 個 token。這些數字是算術推估,不是實測值,但整體趨勢是正確的。

因此,相同的可見工作可能產生非常不同的成本。無論採用哪種方式,你輸入的文字都相同。差異在於這些文字上方累積了多少對話記錄。

長對話還有第二項成本。當對話接近 context window(截至 September 2026,Pro 為 200,000 個 token)時,Claude 會摘要較早的訊息,讓對話能夠繼續;Anthropic 也指出,觸發這項自動 context management 的對話會消耗更多使用量上限。摘要本身需要實際運算,而且會從相同的使用額度中扣除。

你可以觀察這個過程。開啟 Settings,再開啟 Usage;Pro 會顯示 5 小時 session window 與 weekly window 的進度列。在長對話中傳送第 20 則訊息,再在新對話中傳送第 1 則訊息,然後比較進度列移動了多少。session 與 weekly window 的運作方式說明兩者各自在何時重設。

檔案或 PDF 的成本是多少?

ChartInput tokens counted for four short requests
The data behind this chart
[
  {
    "label": "Text question only",
    "input_tokens": 14
  },
  {
    "label": "One tool definition plus a question",
    "input_tokens": 403
  },
  {
    "label": "One JPEG photo plus a question",
    "input_tokens": 1028
  },
  {
    "label": "One small PDF plus a question",
    "input_tokens": 2188
  }
]

以上是 Anthropic token 計算文件中列印的範例輸出,並以 claude-opus-5 為基準。這 4 個提示略有不同,因此請比較差距的大小,不要只看確切數值。簡短的文字問題計算出 14 個輸入 token。附上照片並搭配簡短問題則計算出 1028。附上 1 份小型 PDF(可攜式文件格式檔案)並搭配簡短問題,則計算出 2188,約為純文字問題的 150 倍。

再把這項成本與前文所述的重新傳送合併考量。附件會先轉換成 token,之後每一輪對話都會隨著內容重新傳送。若在第 1 則訊息附上 40 頁的報告,到了第 2 則、第 3 則以及第 20 則訊息,仍會再次支付這 40 頁的成本。

已發布的每頁數據相當高。在 API(應用程式介面)中,相關數字已有文件說明。PDF 每頁通常會使用 1,500 至 3,000 個文字 token,取決於內容密度,此外還要加上頁面影像的成本,因為每頁也會轉換成影像。40 頁在提出任何問題前,就已經耗用超過 60,000 個 token。相較於 200,000 個 token 的上下文視窗,這會占用很大一部分空間,而且其中可能包含你不需要的頁面。

因此,做法很簡單。只附上你需要的部分,不要附上整個檔案。要求 Claude 閱讀報告並找出付款條款,之後每一輪對話都會支付整份報告的成本。貼上付款條款所在的章節,則只需支付一次幾百個 token。

為何螢幕擷取畫面的成本高於表面所見

ChartVisual tokens for one image, by pixel size and model tier
The data behind this chart
[
  {
    "label": "200 x 200 crop",
    "standard_tokens": 64,
    "high_res_tokens": 64
  },
  {
    "label": "1000 x 1000 screenshot",
    "standard_tokens": 1296,
    "high_res_tokens": 1296
  },
  {
    "label": "1920 x 1080 screenshot",
    "standard_tokens": 1560,
    "high_res_tokens": 2691
  },
  {
    "label": "3840 x 2160 screenshot",
    "standard_tokens": 1560,
    "high_res_tokens": 4784
  }
]

Claude 會將影像讀取為由區塊組成的網格。每個區塊都是 28 x 28 像素,並計為 1 個視覺 token。因此,影像成本為寬度除以 28 後無條件進位,再乘以高度除以 28 後無條件進位。1000 x 1000 像素的螢幕擷取畫面會耗用 1296 個視覺 token,這比多數人整個問題的 token 數還多。

模型選擇也會影響成本。Claude 4.7 與後續模型會以更高的解析度層級讀取影像,因此完整的 4K 螢幕擷取畫面在這些模型上會耗用 4784 個視覺 token;較舊的模型則會先縮小影像,只耗用 1560 個。檔案相同、畫面相同,但 token 數約為 3 倍。

Claude 應用程式單則訊息最多接受 20 張影像。在尚未輸入任何文字前,20 張完整螢幕擷取畫面就已經構成非常大的請求;而且該對話後續的每一輪都會再次帶入全部影像。請改為裁切影像。只包含實際錯誤訊息的 200 x 200 像素裁切圖會耗用 64 個視覺 token,通常也比整個桌面的畫面更能有效回答問題。

思考與 effort level 的成本是多少?

Effort 會控制 Claude 在回答前進行多少思考。在 Claude app 中,這項設定位於傳送按鈕旁的模型選單,等級依序為 low、medium、high、extra high 和 max。Anthropic 明確說明其中的取捨:較高的 effort 會使用更多 tokens,因此會更快達到使用量上限。同一頁也建議日常工作使用 low 或 medium,因為較低的 effort 能延長可用量。

思考也會產生後續成本。在會保留先前對話內容的模型中,先前回答所使用的思考內容,會在該對話後續的每一輪都算入 input tokens。較長的推理工作階段會在執行時計費一次,之後每則訊息又會再次部分計入。

模型選擇還有另一項容易被忽略的影響。Tokenizer 會將文字切分為 tokens,而 Claude 4.7 已變更 tokenizer。相同的輸入文字在 Claude 4.7 及後續模型中,產生的 tokens 約比舊版模型多 30 percent。Anthropic 未公開這些數量如何換算成 Pro 使用量上限的占比,因此應將此視為日常工作使用較輕量設定的理由,而不是可據以換算的匯率。至於 pay as you go,計費方式是公開的,而且 input tokens 與 output tokens 的定價不同

為何代理程式與 Claude Code 最快耗盡使用額度

Claude Code 與 Claude 應用程式共用同一份使用額度。

Pro 與 Max 方案都提供 Claude 和 Claude Code 共用的使用量上限,這表示兩項工具中的所有活動都會計入相同的使用量上限。

代理程式工作讀取的內容遠多於寫入的內容。一次修正錯誤的請求,可能會開啟 10 個檔案、執行搜尋、讀取結果,最後只用 4 行文字說明。你看到的是 4 行文字,但使用量上限計入的是途中讀取的每個檔案。這是工作階段外觀與實際成本之間最大的落差。

工具在你提出任何要求前也會消耗 token,因為每項工具的描述都會隨請求傳送。在上方公布的範例中,不含工具的簡短問題計入 14 個輸入 token,而帶有 1 項工具定義的簡短問題則計入 403 個輸入 token。實際的代理程式設定通常會包含遠多於 1 項工具。

在 Claude Code 中,/status 會顯示工作階段剩餘的使用量。縮小工作內容的上下文是你能採取的最有效措施,而管理長時間 Claude Code 工作階段中的上下文會說明具體做法。代理程式框架在你輸入第一項指示前所帶來的額外負擔則說明其餘的落差。

為何相同工作在某些語言中成本更高

此 tokenizer 主要以英文文字訓練,因此常見的英文單字通常各自只佔用 1 個 token。相同的意思若以俄文、阿拉伯文、印地文或日文撰寫,通常會被切分成更多 token,因此相同的問題會消耗更多額度。本頁介紹的運作方式在所有語言中都相同,但每個句子的成本並不相同。

請測量自己的使用情況,不要只依賴估算。Anthropic 的 token counting endpoint 可免費呼叫,並會回傳任何訊息的輸入 token 數量:

curl https://api.anthropic.com/v1/messages/count_tokens \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "content-type: application/json" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "claude-opus-5",
    "messages": [{"role": "user", "content": "Paste your paragraph here"}]
  }'

回應只有一行:

{"input_tokens": 14}

執行 2 次:第一次使用英文段落,第二次使用相同段落的本身語言版本,然後比較兩個數字。呼叫此 endpoint 不收費,但需要來自 Claude Console(platform.claude.com)的 API key。這是與 Pro 訂閱分開的帳戶。改用英文通常不是好的取捨,因為你使用自己的語言思考和寫作通常更快。請改為縮短對話串並減少附件大小。這兩個習慣對你的幫助通常比對英文使用者更大。

讓 Pro 方案維持更久的使用習慣

  • 主題變更時開始新的對話。這是清單中最重要的習慣,因為對話串越長,後續每則訊息的成本都會增加。
  • 附加所需部分,不要附加整個檔案。提供 3 頁,而不是 40 頁。
  • 將螢幕擷取畫面裁切至只保留錯誤訊息。
  • 將固定背景資訊放在 project 中,不要貼到每個新對話。Anthropic 表示,project 中的內容會經過快取,重複使用時不會計入使用限制,因此 style guide 或 schema 應放在 project knowledge 中。
  • 例行問題使用 low 或 medium effort,將 high effort 留給值得投入的工作。
  • 在一則訊息中完整提出問題。分 3 輪釐清的成本高於一次提供詳細訊息,因為每一輪都會重新傳送前面的所有內容。

額度已用完時

截至 2026 年 9 月,Pro 每月按月計費時為 $20;按年計費時,平均每月為 $17。Anthropic 表示,Pro 每個五小時工作階段的用量至少是免費方案的五倍。Pro 的費用與用量上限說明方案本身的內容。上述使用習慣能增加實際用量,但仍有上限。如果每月只用完一次,這些方法就能解決問題。如果你在有報酬的工作中每隔幾天就用完額度,判斷 Max 是否適合會是更有效的時間運用方式。

FAQ

為什麼我今天的 Claude Pro 額度這麼快就用完了?

幾乎總是因為對話很長、包含附件,或兩者兼有。每則訊息都會重新傳送整個對話串,因此即使你輸入的字數相同,第 20 則訊息的成本也可能是第 2 則的許多倍。附件也會隨每則訊息重新傳送。開啟 Settings,再選取 Usage,查看你在 5 小時工作階段與每週時段中已使用的額度,並為無關的問題分別建立新的對話。

建立新的對話能節省使用額度嗎?

可以,而且這是最省額度的做法。新的對話不含歷史記錄,因此第一則訊息只會計算你輸入的內容。代價是 Claude 不再知道先前的內容,因此請貼上有用部分的簡短摘要,不要貼上整個舊對話。將完整的舊對話貼到新對話中,等於重新建立你原本想避開的相同問題。

附件在第一則訊息之後仍會持續消耗使用額度嗎?

會,在同一個對話中會持續消耗。檔案會先轉換成 tokens,而這些 tokens 會成為對話歷史的一部分,之後的每一輪訊息都會帶上這些內容。40 頁的 PDF 會持續存在於請求中,直到對話結束。放在 project 中的檔案則是例外,因為 Anthropic 表示,project 內容會被快取,重複使用時不會計入額度限制。

使用英文以外的語言書寫,會消耗更多使用額度嗎?

通常會。對相同的意思而言,tokenizer 會將非英文文字切分成更多 tokens,因此相同問題以俄文或日文提出時,成本會高於英文。你可以使用免費的 token counting endpoint,分別計算兩種語言中的同一段文字,自行測量差異。與其切換語言,不如縮短對話串並減少附件大小。這些做法對你節省的額度,會比對使用英文者節省得更多。

Claude Code 使用的額度,和 Claude 應用程式使用的是同一份嗎?

是。Anthropic 表示,Pro 與 Max 的使用額度在 Claude 和 Claude Code 之間共用,因此兩者的活動都會計入相同的限制。Agent 工作階段會快速消耗額度,因為單一請求可能在回覆前讀取許多檔案並執行數個工具。在 Claude Code 中執行 /status,即可查看目前工作階段剩餘的額度。