如何估算自己的 Claude 月账单
用一周真实用量估算您的月账单:统计对话、轮数和回复长度,换算 token 后,分别套用 Claude Pro 与 API 费率。
Claude 账单由什么决定
Claude 账单的计算方式只有一个乘法:您发送和接收的 token 数量,乘以这些 token 的价格。token 是一段文本;1 个 token 约等于 4 个英文字符,或约等于 0.75 个英文单词。发票上的每一行费用都来自这个数量。
两个事实决定了大部分计算结果。在当前所有 Claude 模型中,输出 token 的价格都是输入 token 的 5 倍,因此回答长度对账单的影响大于问题长度。对话会在每次交互时重新发送完整历史记录,因为 Messages API 不会在请求之间保存任何内容:您每次发送消息时,客户端都会重新发送整个会话。长会话的费用会远高于其中可见文本本身的费用。
计算分为 3 步。第 1 步统计您实际使用情况中的普通一周。第 2 步将这一周的数据换算为 token 数量。第 3 步按多个费率计算同一个月的费用。使用您自己的数据运行计算后,得到的是您自己账户的费用,而不是一份价目表。
第 1 步:测量一周的实际使用量
不要凭记忆估算。记忆会产生单向偏差:你会记住自己输入的问题,却忘记随问题一同产生的历史记录。测量一个普通工作周,并记录4个数字。
- 每个工作日发起的对话数。
- 典型对话中的轮数。一轮包括一条消息和一条回复。
- 典型回复的长度,以单词数计算。阅读3条实际回复并取平均值。
- 附加的文档和图像数量,以及每个文件的大小。
如果你使用 API 或编码代理,准确的计数已经存在,因此应使用这些计数,而不是统计单词数。每个 Messages API 响应都包含一个 usage 对象:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0
}
}记录这4个字段一周后,测量步骤就完成了。在 Claude Code 中,/usage 会输出当前会话的相同总量,并显示 Total cost 行。该行由 CLI 根据按目录价计算的 token 数量在本地生成,因此只是估算值。Claude Console 中 platform.claude.com/usage 的 Usage 页面才是与发票一致的记录;跟踪 Claude Code 长期支出的工具读取的也是你在这里记录的相同 token 数量。
对于尚未运行的工作,应在定价前先统计。token 计数端点可免费调用,并使用与真实消息相同的请求正文。
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'响应是一个数字。对于该请求,结果为 {"input_tokens": 14}。请根据计划使用的模型进行统计,因为 Claude Opus 4.7 及更高版本使用更新的 tokenizer,相同文本在这些模型上的计数大约高出30%。在旧模型上获取的计数会使账单大约低估相同比例。
第 2 步:将一周转换为令牌
下面给出一个完整的一周示例,计算到本页末尾。阅读时,请将每个数字替换为您自己的数字。5 个工作日中每天进行 8 次对话,共 40 次对话。每次对话包含 9 轮。您发送的典型消息约为 110 个单词,即 150 个令牌。典型回复约为 450 个单词,即 600 个令牌。一周内附加 5 份文档,每份约 6,000 个单词,即每份 8,000 个令牌。
一次对话的可见文本并不多:9 条消息和 9 条回复,共 6,750 个令牌。但计费输入量并不少,因为第 2 轮会携带第 1 轮的内容,第 3 轮会携带第 1 轮和第 2 轮的内容,后续轮次也遵循同样的规律。
The data behind this chart
[
{
"turn": 1,
"input_tokens": "150",
"cumulative_input_tokens": "150"
},
{
"turn": 2,
"input_tokens": "900",
"cumulative_input_tokens": "1,050"
},
{
"turn": 3,
"input_tokens": "1,650",
"cumulative_input_tokens": "2,700"
},
{
"turn": 4,
"input_tokens": "2,400",
"cumulative_input_tokens": "5,100"
},
{
"turn": 5,
"input_tokens": "3,150",
"cumulative_input_tokens": "8,250"
},
{
"turn": 6,
"input_tokens": "3,900",
"cumulative_input_tokens": "12,150"
},
{
"turn": 7,
"input_tokens": "4,650",
"cumulative_input_tokens": "16,800"
},
{
"turn": 8,
"input_tokens": "5,400",
"cumulative_input_tokens": "22,200"
},
{
"turn": 9,
"input_tokens": "6,150",
"cumulative_input_tokens": "28,350"
}
]第 1 轮计费 150 个输入令牌。第 9 轮计费 6,150 个输入令牌,即使消息长度完全相同,因为它会携带此前的全部内容。整次对话共计费 28,350 个输入令牌,约为线程中现有文本的 4 倍。增长速度高于轮次数量:轮数翻倍时,输入成本大致增加到 4 倍。因此,控制工作上下文的大小不仅是质量问题,也是成本问题。
附件遵循相同的规则,也是估算最容易出错的地方。在 9 轮对话的第 1 轮附加一份文档后,该文档会被发送 9 次。因此,8,000 个 PDF(portable document format)令牌会变成 72,000 个计费输入令牌。如果附加同一个文件,在 2 轮内获得回复,然后开始一次新的对话,则成本为 16,000 个令牌。
将一周的结果乘以 4,即可得到一个工作月的结果。
The data behind this chart
[
{
"label": "Conversation text",
"input_tokens": "4,536,000",
"output_tokens": "864,000"
},
{
"label": "Attached documents",
"input_tokens": "1,440,000",
"output_tokens": "0"
},
{
"label": "Month total",
"input_tokens": "5,976,000",
"output_tokens": "864,000"
}
]一个月共计 5,976,000 个输入令牌和 864,000 个输出令牌。查看输入令牌的来源。1,440,000 个输入令牌来自 5 份被反复发送的文档,约占 5 个文件输入账单的四分之一。如果您运行的是 coding agent,而不是进行聊天,计算规则仍然相同;此外,每个请求还会包含 agent harness 在您输入任何内容之前发送的工具定义和系统提示词。
第 3 步:按 API 费率计算当月费用
费率按每百万 token 计算。这些费率于 2026 年 9 月 4 日核对过。价格会变化,因此在采信任何版本的费率(包括本文中的费率)之前,请先从 Anthropic 获取当前数值。
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5,
"cache_read_usd": "0.10"
},
{
"label": "Sonnet 5",
"input_usd": 2,
"output_usd": 10,
"cache_read_usd": "0.20"
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25,
"cache_read_usd": "0.50"
}
]三个指标的输出都正好是输入的五倍,缓存读取费用是输入价格的十分之一。这种比例说明了为什么 输入和输出 token 应在估算中分别列出。按百万 token 计算后,算式只需进行一次除法,这也是为什么 一百万 token 是值得掌握的计算单位:在 Sonnet 5 上,本月输入 token 为 5.976 million,每个 token 的价格为 2 美元;输出 token 为 0.864 million,每个 token 的价格为 10 美元。
The data behind this chart
[
{
"label": "Input, no caching",
"cost_usd": "11.95"
},
{
"label": "Input, with caching",
"cost_usd": "3.83"
},
{
"label": "Output",
"cost_usd": "8.64"
}
]不使用缓存时,输入费用为 $11.95,输出费用为 $8.64。输出 token 约占总 token 的八分之一,但约占总费用的五分之二。
提示缓存会改变输入这一项,但不会改变输出这一项。缓存写入费用是输入价格的 1.25 倍,缓存有效期为五分钟。缓存读取费用是输入价格的 0.1 倍。在此工作负载中,每月输入 token 约有五分之一是首次发送的新文本,其余是重复读取的相同历史内容,因此输入费用降至 $3.83。这一节省假设每次交互都在缓存有效期内完成,并且重复前缀足够长,可以进行缓存;低于可缓存最小长度的提示永远不会被存储。缓存的盈亏平衡点是在五分钟缓存有效期内完成一次缓存读取,因此实时对话几乎会立即达到该点。
订阅不再更划算的地方
The data behind this chart
[
{
"label": "Claude Pro subscription",
"cost_usd": "20.00"
},
{
"label": "API, Sonnet 5",
"cost_usd": "20.59"
},
{
"label": "API, Sonnet 5 with caching",
"cost_usd": "12.47"
},
{
"label": "API, Opus 5",
"cost_usd": "51.48"
},
{
"label": "API, Haiku 4.5",
"cost_usd": "10.30"
}
]Claude Pro 按月计费时每月为 $20.00,也可以一次性支付 $200 使用一年,折合每月 $17。Max 起价为每月 $100,完整的套餐及价格列表包含更高价位的级别。以上是截至 September 2026 公布的价格。
按 Sonnet 5 价格计算,示例月份的费用为 $20.59,与 Pro 相差不到 $1。这就是该工作负载的临界点。将完全相同的工作转到 Opus 5 后,费用为 $51.48,因此订阅反而更便宜。启用缓存后,API 费用降至 $12.47。使用 Haiku 4.5 运行时,费用为 $10.30,相同工作量的费用约为订阅价格的一半。
请仔细理解这一比较,因为它只比较美元金额。订阅不对应固定数量的 token,而且 Anthropic 不会以 token 公布套餐限制,因此本页的任何计算都无法说明你的使用量是否能满足 Pro 的一周额度。它能说明的是,按公开价格计算,你的消费对应多少费用;这是比较两者时应采用的合理方法。套餐限制的实际衡量方式是另一个问题,API 计费与订阅之间的全面比较则涵盖非价格因素,例如高负载月份的费用由哪一方承担。
一个结构性差异决定了大多数实际情况。订阅的上限是使用量限制,因此高负载月份和低负载月份的费用相同,最坏的情况是等待限制重置。API key 的上限取决于你的支付卡,因此陷入循环的 agent 会为其消耗的每个 token 计费。在让任何任务无人值守地运行前,请先在 Console 中设置 workspace 支出上限。
改变结果的4个关键因素
- 模型选择。 同一个月,在 Opus 5 上的费用为 $51.48,在 Haiku 4.5 上为 $10.30,相差5倍,因为输入、输出和缓存费率会一起变化。将简单任务交给较小的模型,是您能采取的最大单项优化措施。
- 缩短线程。 3个独立的3轮对话,每个对话计费 2,700 个输入 token;如果使用一个涵盖相同内容的9轮线程,则计费 28,350 个输入 token。主题发生变化时,请开始新的对话。在 Claude Code 中,
/clear也能完成相同的工作。 - 缓存。 它将此工作负载的输入部分减少了约三分之二,而且启用不产生费用。当缓存有效期内相同的前缀被读取多次时,缓存就能节省费用。
- 批处理。 对于可以等待的任务,Batch API 可将输入和输出费用都降低50%,并且可以与缓存叠加使用。它异步运行,因此不适用于交互式聊天,只适用于批量任务,例如在夜间对积压任务进行分类。
另外还有两项容易被忽略的因素会改变费用。扩展思考按输出 token 计费,因此较高的工作强度会增加账单中最昂贵的部分。编码代理消耗 token 的方式也与只测量聊天的用户所预期的不同;Claude Code token 的实际去向分解按轮次对此进行了说明。获得自己的数据后,真正降低 Claude 账单的措施也应从这些相同的测量结果开始。
如需与其他人的数据进行合理比较:Anthropic 报告称,在企业部署中,Claude Code 的成本约为每位开发者每个活跃日 $13,每位开发者每月 $150 至 $250;90% 的用户每个活跃日的费用低于 $30。这些是面向高强度编码使用场景的已发布平均值,并不是对您账户费用的预测。您实际测量的一周数据,比任何已发布的平均值都更有参考价值,这正是进行测量的意义所在。
如果您使用美元以外的货币付款
套餐价格以美元标示。您的银行会在扣款当天按其自身汇率完成换算。美国以外发行的银行卡还可能额外收取跨境手续费。因此,账单上的金额不会与标价完全一致。根据您的居住地,结账时可能还会加收当地销售税或 VAT(增值税)。请按高于美元金额的一小部分预留预算,不要只按精确金额准备。每当汇率发生变动后,也请重新核对金额。
可用性与价格是两个不同的问题。Claude 和 Claude API 仅在特定国家和地区提供,支持列表也会变化,因此请直接查阅来源:支持的国家和地区。
FAQ
一条消息包含多少 tokens?
英文每个 token 约对应 4 个字符,或一个单词的四分之三,因此 450 个单词的回复约为 600 tokens。这个估算足以用于预算。要获取精确数量,请将请求正文发送到免费的 count_tokens 端点 https://api.anthropic.com/v1/messages/count_tokens,然后读取它返回的 input_tokens 字段。请按实际使用的模型计算,因为从 Claude Opus 4.7 开始的模型,对相同文本的计数比早期模型高约 30%。
为什么我的账单高于我写入的文本量?
因为每一轮请求都会重新发送完整对话。API 不会在请求之间保留状态,因此线程的第 9 轮会携带第 1 至第 8 轮的内容。在上面的示例中,一个包含 6,750 个可见文本 tokens 的对话会产生 28,350 个输入 tokens 的费用。你附加的文件也会在同一线程的后续每一轮中重新发送,因此一个 8,000 token 的文档可能产生 72,000 个输入 tokens 的费用。
Claude API 比 Pro 订阅便宜吗?
这取决于你使用的模型和上下文长度,而不是订阅方案。按示例计算,一个月使用 Sonnet 5 的费用为 $20.59,与 $20 的 Pro 持平。同一个月使用 Opus 5 的费用为 $51.48,使用 Haiku 4.5 的费用为 $10.30。请先按实测的一周用量分别计算两种方案的费用,再做决定。请注意,订阅会限制你的用量,而 API key 不设用量上限,因此无人值守的自动化任务应配置在 Console 的支出限额之后。
提示缓存是否总能节省费用?
不能。写入缓存的费用是输入价格的 1.25 倍,因此写入缓存后再也不读取的内容,其费用高于只发送一次的费用。当相同前缀在缓存有效期内至少再次读取一次时,缓存才有优势。持续进行的对话,或始终使用固定系统提示词的代理,都会出现这种情况。低于最小缓存长度的提示词不会存储到缓存中,因此缓存不会改变短暂的一次性调用的费用。