Claude 达到使用上限后怎么办?
先确认是5小时会话窗口、每周额度还是指定模型限制,再选择等待、切换Sonnet或Haiku、缩短上下文、购买用量额度,或改用API。
已达到哪项 Claude 限制
Claude 达到限制的消息会说明需要等待哪个时间窗口。该窗口决定你接下来可以执行的操作。会话限制和每周限制同时适用于所有模型,因此切换模型不会恢复访问权限。消息中指定某个模型的限制是例外:切换模型后,你仍可继续工作,而被限制的模型仍处于不可用状态。
Claude Code 会在同一行显示时间窗口及其重置时间:
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm会话窗口按连续5小时滚动计算。每周窗口会在每周固定时间重置,该时间由系统分配给你的账户,因此每周的日期和小时都相同。Pro 计划包含5小时会话窗口,以及一个适用于所有模型的每周限制。Max 计划会额外提供第二个每周限制,该限制仅适用于某个模型系列。具体额度请参阅Claude 使用限制的完整说明。本页从该说明之后的实际问题开始介绍。
以下情况最容易造成误解。每个请求会同时计入会话窗口和每周窗口,因此一个高强度的下午可能耗尽每周额度,而5小时窗口仍有剩余额度。规划当天剩余时间前,先查看重置时间。下午3:45重置,通常只需稍作等待。周一午夜重置,则需要等待更长时间。
查看用量后再判断
在 claude.ai 中打开 Settings,然后打开 Usage。进度条会显示您在五小时会话窗口和每个每周窗口中已用的额度,因此您可以直接看到哪个窗口已用尽,而不必猜测。
在 Claude Code 中运行 /usage。它会显示相同的套餐用量条,并按占总用量的百分比,细分近期用量来自哪些 skills、subagents、plugins 和各个 MCP(模型上下文协议)服务器。按 d 查看最近 24 小时,按 w 查看最近 7 天。它还会标记占近期用量 10% 或以上的模式。最常见的两项是长上下文和缓存未命中。
有两点需要注意。此细分基于存储在该机器上的会话历史计算,因此您在另一台笔记本电脑或 claude.ai 上进行的工作不会计入。顶部 Session 区块中的美元金额按 API(应用程序编程接口)用户的标准目录价格计算。因此,当您使用订阅时,该金额不是您的实际账单。
切换到更小的模型有帮助吗?
只有在消息中指定模型时才有帮助。在 You've hit your Opus limit 之后运行 /model,选择 Sonnet 或 Haiku,会话会保留全部上下文并继续运行。在 You've hit your session limit 或 You've hit your weekly limit 之后,/model 不会产生任何变化,因为这些窗口由所有模型共享。
在达到上限之前切换模型,收益远高于达到上限之后。Sonnet 可以完成大多数编码工作,但费率只是 Opus 的一小部分。因此,始终将 Opus 设为默认模型,是造成意外用量的两个主要习惯之一。另一个习惯是从不清理会话。将机械式编辑和日志分析交给 Haiku,只在确实无法决定设计方案时使用 Opus。在 Opus、Sonnet 和 Haiku 之间选择介绍了每个模型在哪些场景下值得其价格。
停止为不再使用的上下文付费
Claude Code 会在每次请求中发送完整的对话。每次 Claude 使用工具时,它还会发送另一个包含该批工具结果的请求。提示缓存会让历史记录按缓存费率重新读取,而不是按完整输入费率重新读取,因此只能降低成本,不能完全免费。也就是说,在一个从早上一直保持打开的会话中,即使只问一个问题,也仍会按整个对话计算用量。
/context
/clear
/compact Focus on the failing tests and the files we changed/clear 不产生费用,因为它会直接丢弃上下文,而不是读取上下文。/compact 必须读取要压缩的对话,因此压缩非常大的上下文本身就是一个很大的请求。切换到无关工作时,使用 /clear;只有在任务进行到一半且需要保留当前上下文时,才使用 /compact。清除之前运行 /rename,这样就能通过 /resume 再次找到该会话。
缓存生命周期的重要性超出大多数人的预期。订阅用户的缓存会保留 1 小时。一旦开始使用用量额度,缓存时间会缩短为 5 分钟;API key 的默认缓存时间也是 5 分钟。午餐后长时间未使用时发送的第一条消息无法命中缓存,并会按完整输入价格重新处理整个上下文,因此用量经常会在没有明显原因的情况下增加。提示缓存何时能够收回成本介绍了相关计算方法。
同一位置还有 3 个可调节项。/mcp 会列出已配置的服务器,便于关闭当前任务不需要的服务器。较长的 CLAUDE.md 会在会话开始时加载,无论当前工作是否需要其中的内容,因此应将专用指令移入 skills,仅在调用时加载。扩展思考按输出 token 计费,而输出是成本较高的一部分,因此可以使用 /effort 降低级别,使用 /config 将其关闭,或者在具有固定思考预算的模型上设置 MAX_THINKING_TOKENS=8000。
将任务拆分,使其适合在一个窗口内完成
在进行较大改动前,按 Shift+Tab 切换到规划模式。Claude 会探索代码库并提出方案供您确认。这样可以在早期发现错误方向,代价是一个规划周期,而不是投入两个小时编辑后再返工。
将输出量较大的操作交给子代理。在子代理中运行测试套件或读取 10,000 行日志,可以让原始输出保留在该子代理的上下文中,主对话只接收摘要。
Claude 一旦开始朝错误方向执行,就立即按 Escape。/rewind 会将对话和代码都恢复到较早的检查点,因此您无需为不需要的改动支付回滚成本。
应购买用量额度,还是使用 API?
用量额度允许 Pro 或 Max 账户在超出套餐额度后继续使用,并按标准 API 费率计费。在 claude.ai 中打开 Settings,然后进入 Usage,绑定支付方式后启用用量额度;也可以在 Claude Code 中运行 /usage-credits,该命令会在浏览器中打开账单设置。额度可用于 Claude 对话和 Claude Code 终端用量,每日兑换上限为 $2000。该命令需要使用订阅账户登录,因此使用 API key 进行身份验证时不可用。
另一种方式是从 Claude Console 获取普通 API key。该方式按 token 计费,完全没有会话或每周时间窗口。但有一个容易忽略的问题:如果环境中残留 ANTHROPIC_API_KEY,Claude Code 会直接通过该 key 使用服务,而不会提示你已绕过订阅。你只能从账单中发现这一点,或者运行以下命令:
API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.这里的 429 表示该 key 触发了速率限制,而不是你的套餐触发了限制。运行 /status,确认当前使用的凭据是你想使用的凭据。
API 使用一个下午要花多少钱?
下面的计算示例表示一次下午的 agent 式编码:200,000 个未缓存输入 token、1.8 million 个缓存读取 token,以及 150,000 个输出 token。价格采用 Anthropic 截至 August 2026 的官方标价。所有价格均按每 million 个 token 报价。如果这个单位仍然不够直观,实际了解 million 个 token 的价值可以将其换算为更容易想象的阅读和写作量。
The data behind this chart
[
{
"label": "Opus 5",
"input_usd_per_mtok": 5,
"cache_read_usd_per_mtok": 0.5,
"output_usd_per_mtok": 25,
"afternoon_usd": 5.65
},
{
"label": "Sonnet 5",
"input_usd_per_mtok": 2,
"cache_read_usd_per_mtok": 0.2,
"output_usd_per_mtok": 10,
"afternoon_usd": 2.26
},
{
"label": "Haiku 4.5",
"input_usd_per_mtok": 1,
"cache_read_usd_per_mtok": 0.1,
"output_usd_per_mtok": 5,
"afternoon_usd": 1.13
}
]同一个下午,使用 Opus 5 的成本为 $5.65,使用 Haiku 4.5 的成本为 $1.13。输出 token 决定了总成本:Opus 5 的输出价格为每 million 个 token $25,Haiku 4.5 为 $5。因此,Claude 写出的 150,000 个 token 比它读取的 2 million 个 token 成本更高。这就是降低 thinking budget 比减少文件更能节省成本的原因。
需要注意一个日期。Sonnet 5 在 31 August 2026 前采用 introductory pricing,输入和输出价格分别为每 million 个 token $2 和 $10;从 1 September 2026 起,价格将调整为 $3 和 $15。同一个下午的成本也会从 $2.26 上升到约 $3.39。
每个下午成本的计算方式
Opus 5:200,000 个未缓存输入 token,价格为每 million 个 token $5,成本为 $1.00。1.8 million 个缓存读取 token 按输入价格的十分之一计费,成本为 $0.90。150,000 个输出 token,价格为每 million 个 token $25,成本为 $3.75。总计为 $5.65。
Sonnet 5:未缓存输入成本为 $0.40,缓存读取成本为 $0.36,输出成本为 $1.50。总计为 $2.26。
Haiku 4.5:未缓存输入成本为 $0.20,缓存读取成本为 $0.18,输出成本为 $0.75。总计为 $1.13。
3 行数据均假设 token 数量相同,因此它们之间的差额完全来自价格。实际使用一个下午的成本会有所不同,取决于上下文中有多少内容保持缓存状态。
作为参考,Anthropic 的官方文档显示,截至 August 2026,企业部署中 Claude Code 的平均支出接近每位开发者每个活跃日 $13;90% 的用户每个活跃日支出低于 $30。按 token 计费并不一定比订阅更便宜。当使用量有明显峰谷时,按 token 计费更有优势,因为不使用的日期不会产生费用;如果每天都工作,则订阅通常更有优势。将 API 与订阅按实际数字进行比较可以看到两者的成本临界点。
在 VPS 上让长时间任务运行一夜
有些任务不需要您持续查看,例如大型重构、测试迁移和文档全面检查。这些任务也不需要占用您的订阅窗口。将它们放到配置了 API key 的 VPS(虚拟专用服务器)上,任务会按 token 使用量计费,而您的套餐额度可以留到明天执行交互式工作。
在 Ubuntu 服务器上安装 Claude Code,并确认它可以运行:
curl -fsSL https://claude.ai/install.sh | bash
claude --versionclaude --version 应输出类似 2.1.211 (Claude Code) 的版本字符串。这里出现 command not found,表示 ~/.local/bin 尚未位于您的 PATH 中,请打开新的 shell 后重试。
将 key 放入文件,而不是让它出现在 shell 历史记录中。使用编辑器创建 ~/.claude-env,写入一行 export ANTHROPIC_API_KEY=sk-ant-your-key-here,然后限制文件权限并加载它:
chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10最后一行会输出前十个字符。这样足以确认变量已设置,同时不会将完整 key 显示在屏幕上。
现在在 tmux 中启动任务,使其在您关闭笔记本电脑后仍能继续运行:
tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
--allowedTools "Read,Edit,Bash" \
--append-system-prompt-file ./CLAUDE.md \
--output-format json > ~/overnight.json按 Ctrl-b,然后按 d 分离会话,再关闭连接。稍后使用 tmux attach -t overnight 重新连接。VPS 上 tmux 会话中的 Claude Code 详细介绍了会话管理。
这里 --bare 很重要。它会跳过 hooks、skills、plugins 和 CLAUDE.md 的自动发现,并且不会读取 OAuth 凭据。因此,本次运行只使用 API key,不使用其他凭据。这可以确保任务不会占用您的订阅额度。这样也会导致项目规则不可用,因此 --append-system-prompt-file 会有意将这些规则传回。没有 --bare 时,设置 ANTHROPIC_API_KEY 会触发一次性批准提示,而无人值守的运行无法回答该提示。
早上读取 JSON 中的结果和费用:
jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.jsonClaude Code 成功时退出状态为 0,运行失败时退出状态为非零。因此,包装脚本可以根据退出状态进行分支,并通过邮件通知您失败情况。在离开前,请先在 Claude Console 中设置工作区支出上限:凌晨 3am 处于重试循环中的 agent 确实可能持续产生费用。如果还希望降低运行速度,可以调低 CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY。无人值守运行 agent 的费用控制将介绍应优先设置的上限。
为该任务创建单独的非特权用户,并使用单独的 git 分支。无人值守地编辑代码仓库的 agent 偶尔会执行您本来会阻止的操作,而分支可以让这成为 git checkout,而不是一次事故。在 VPS 上安全运行 coding agent介绍了隔离方法。
对于完全不需要交互的批量任务,例如对数千条记录进行分类,Batch API 会异步处理请求,并对输入和输出 token 均提供 50% 的折扣。这是 Anthropic 发布的每 token 成本最低的方式,而一夜的运行窗口正好满足它所需的延迟。
哪些操作无法恢复您的使用额度
开始新对话不会恢复您的使用额度。用量计入您的账户,而不是某个对话。这样做确实会让之后的每条消息成本更低,因为新对话无需重新读取历史记录,因此仍然值得操作。这只是降低成本,不会重置额度。
删除旧对话不会退还任何额度。这些 token 在处理时就已经消耗。
在会话或每周消息达到限制后切换模型不会产生任何效果,因为这些时间窗口由所有模型共享。只有明确指定模型的消息才会响应 /model。
循环重试不会产生任何效果,只会让终端持续忙碌。消息中显示的重置时间才是实际答案,/usage 会在不显示错误的情况下显示相同的时间。
FAQ
我的 Claude 限额多久后重置?
消息中会告诉您。会话限额按连续五小时滚动计算,消息会显示具体时间,例如 resets 3:45pm。每周限额会在每周为您的账户指定的固定时间重置,消息会显示星期几,例如 resets Mon 12:00am。如果您想在达到限额前查看两条进度条和两种重置时间,可以在 Claude Code 中运行 /usage,也可以在 claude.ai 中依次打开 Settings 和 Usage。
切换到 Sonnet 后能恢复使用吗?
只有消息中明确提到某个模型时才可以。出现 You've hit your Opus limit 后,运行 /model,选择其他模型,会话会保留现有上下文并继续运行。出现 You've hit your session limit 或 You've hit your weekly limit 后,选择模型没有作用,因为这些时间窗口会合并统计所有模型的用量。在达到限额前切换到更便宜的模型,才是真正延长时间窗口的方法。
开始新的聊天会重置使用限额吗?
不会。用量按账户统计,因此新聊天仍会使用同一个剩余额度。新聊天不会包含历史记录,Claude 无需重新读取这些内容,因此后续每条消息的成本会降低。在 Claude Code 中,/clear 也有相同作用,且不产生费用;而 /compact 需要读取它要总结的对话,因此压缩非常大的会话本身就是一次高成本请求。
API 比升级套餐便宜吗?
取决于您的用量是否稳定。本页示例中的一个下午工作量,按 2026 年 8 月的公开价格计算,使用 Sonnet 5 的费用为 $2.26,使用 Haiku 4.5 的费用为 $1.13。订阅按固定费用提供有上限的额度,因此如果您大多数工作日都会使用,它更划算。按 token 计费则适合用量波动较大的情况,因为完全没有用量的日期不会产生费用。
等待限额重置时,可以让任务继续运行吗?
可以,但需要将任务移出订阅范围。将 ANTHROPIC_API_KEY 设置为环境变量后在 VPS 上运行任务,费用会按 token 计费,而不会消耗套餐的时间窗口,因此两者不会相互竞争。在 tmux 中运行 claude --bare -p 可以在您合上笔记本电脑后继续运行,--output-format json 会写入一个 total_cost_usd 字段,您早上可以使用 jq 检查该字段。