SSD Nodes Learn Hosting plans →
指南 Matt Connor作者: Matt Connor · 更新于 2026-09-22

Claude 达到限制后怎么办?查看重置时间与解决方案

遇到 Claude 限制提示?先确认是滚动五小时会话窗口、每周窗口还是特定模型限制,再选择小模型、缩短上下文、购买额度或改用 API。

已触发哪项 Claude 限制

Claude 达到限制时显示的消息会指出您需要等待的时间窗口,该窗口决定您接下来可以执行的操作。会话限制和每周限制同时适用于所有模型,因此切换模型不会恢复访问权限。消息中指明某个模型的限制则是例外:切换模型后,您可以继续工作,而受限模型仍保持不可用。

Claude Code 会在同一行显示时间窗口及其重置时间:

You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm

会话窗口为滚动的五小时。每周窗口会在每周固定时间重置,该时间由您的账户分配,因此每周的日期和小时都相同。Pro 计划包含五小时会话窗口,以及一项适用于所有模型的每周限制。Max 计划会额外提供第二项每周限制,该限制仅适用于一个模型系列。具体上限请参阅Claude 使用限制的完整说明。本页将从该说明结束的地方继续介绍。

以下情况最容易被忽略。每个请求会同时计入会话窗口和每周窗口,因此一个高强度使用的下午可能耗尽每周额度,而五小时窗口仍有剩余。规划当天剩余时间前,请先查看重置时间。下午 3:45 重置,影响相当于休息喝杯咖啡。周一午夜重置,则完全不同。

先查看用量,再进行判断

在 claude.ai 中打开 Settings,然后选择 Usage。进度条会显示你在五小时会话窗口和每个每周窗口中已用的额度,因此你可以直接看到哪个窗口已耗尽,而不必猜测。

在 Claude Code 中运行 /usage。它会显示相同的套餐进度条,并按总用量百分比细分近期用量的去向,包括 skills、subagents、plugins 和各个 MCP(model context protocol)服务器。按 d 查看最近 24 小时,按 w 查看最近 7 天。它还会标记占近期用量 10% 或以上的模式。最常见的两项是较长的上下文和缓存未命中。

有两点需要注意。此细分数据根据存储在本机上的会话历史计算,因此你在另一台笔记本电脑或 claude.ai 上进行的工作不会计入,即使这些工作使用了同一额度。这是因为Claude Code 与你的 claude.ai 聊天共用一个订阅窗口。此外,顶部 Session 区块中的金额按 API(application programming interface)用户的标准目录价格计算。如果你使用的是订阅套餐,该金额并不是你的实际账单。

切换到更小的模型有帮助吗?

只有消息中指定了模型时才有帮助。在 You've hit your Opus limit 之后运行 /model,选择 Sonnet 或 Haiku,当前会话会保留全部上下文并继续运行。在 You've hit your session limit 或 You've hit your weekly limit 之后,/model 不会产生任何变化,因为这些上下文窗口由所有模型共享。

在达到上限之前切换,价值远高于达到上限之后。Sonnet 可以完成大多数编码工作,费率只有 Opus 的一小部分。因此,始终将 Opus 设为默认模型,是造成意外用量的两个主要习惯之一。另一个习惯是会话始终不清理。将机械式编辑和日志分类交给 Haiku,把 Opus 留给确实无法决定的设计问题。在 Opus、Sonnet 和 Haiku 之间选择详细介绍了每个模型在什么场景下值得其价格。

停止为不再使用的上下文付费

Claude Code 会在每次请求中发送完整对话。每次 Claude 使用工具时,它还会再次发送一个包含该批工具结果的请求。提示缓存会让历史记录按缓存价格重新读取,而不是按完整输入价格读取,因此它只能降低费用,并不能免费处理上下文。所以,即使您只是在一个从早上一直打开的会话中提出一行问题,系统仍会按整个对话计算用量。

/context
/clear
/compact Focus on the failing tests and the files we changed

/clear 不产生费用,因为它会直接丢弃上下文,而不是读取上下文。/compact 必须读取要压缩的对话,因此压缩非常大的上下文本身也会产生一个很大的请求。切换到无关任务时使用 /clear;只有在任务进行到一半且需要保留当前对话脉络时,才使用 /compact。清除前运行 /rename,这样您可以使用 /resume 再次找到该会话。

缓存生命周期比大多数人预期的更重要。使用订阅时,缓存有效期为 1 小时。开始消耗用量额度后,有效期会缩短为 5 分钟;API key 的默认有效期也为 5 分钟。午餐后间隔较长时间发送的第一条消息无法命中缓存,系统会按完整输入价格重新处理整个上下文,因此用量经常会在没有明显原因的情况下突然增加。提示缓存何时能收回成本介绍了相关计算方法。

同一位置还有另外 3 个可调节项。/mcp 会列出已配置的服务器,您可以关闭当前任务不需要的服务器。较长的 CLAUDE.md 会在会话开始时加载,无论当前任务是否需要,因此应将专用指令移到 skills 中,使其仅在调用时加载。此外,扩展思考按输出 token 计费,而输出是费用较高的一部分,因此可以使用 /effort 降低思考级别,在 /config 中关闭扩展思考,或在具有固定思考预算的模型上使用 MAX_THINKING_TOKENS=8000 进行设置。

将任务拆分,使其适合在一个窗口内完成

在进行较大改动前,按 Shift+Tab 切换到规划模式。Claude 会探索代码库并提出方案供您审核。这样可以及早发现错误方向,成本只是一次规划,而不是先花费两小时编辑,再返工。

将输出量大的操作交给子代理。在子代理中运行测试套件或读取 10,000 行日志时,原始输出会保留在该子代理的上下文中,主对话只会收到摘要。

Claude 一旦开始朝错误方向执行,请立即按 Escape。/rewind 会将对话和代码都恢复到较早的检查点,因此无需为不需要的工作支付回滚成本。

应购买用量额度,还是使用 API?

用量额度允许 Pro 或 Max 账户超出套餐限额后继续使用,并按标准 API 费率计费。在 claude.ai 中打开 Settings,然后进入 Usage,绑定付款方式后启用用量额度;也可以在 Claude Code 中运行 /usage-credits,该命令会在浏览器中打开账单设置。额度可用于 Claude 对话和 Claude Code 终端用量,每天最多兑换 $2000。该命令需要使用订阅登录,因此使用 API key 进行身份验证时不可用。免费套餐完全不提供用量额度,因此首先应选择每月 $20 的 Pro;Pro 增加了哪些功能,以及哪些限制会影响您详细说明了 Pro 的适用范围。如果您大多数星期都需要购买额度,通常提高套餐限额更便宜;$100 和 $200 Max 套餐之间的差异说明了两者的差异在于用量倍数,而不是模型或功能不同。

另一种方式是从 Claude Console 获取普通 API key。它按 token 计费,完全没有会话或每周时间窗口。但这里有一个容易忽略的问题:如果环境中残留 ANTHROPIC_API_KEY,Claude Code 会在不提示的情况下改用该 key,而不是使用您的订阅。您只能从账单中发现这一点,也可以运行以下命令:

API Error: Request rejected (429) · this may be a temporary capacity issue. If it persists, check https://status.claude.com.

这里的 429 表示该 key 触发了速率限制,不是您的套餐触发了限制。运行 /status,确认当前使用的凭据符合您的预期。

一次下午使用 API 要花多少钱?

下面的示例计算了一次下午使用代理式编码的费用:200,000 个未缓存输入 token、1.8 million 个缓存读取 token,以及 150,000 个输出 token。价格采用 Anthropic 截至 August 2026 的公开费率。所有费率均按每 million 个 token 报价。如果这个单位仍然比较抽象,可以查看一个 million 个 token 实际相当于多少内容,将其换算成更直观的阅读和写作量。

ChartOne afternoon of agent work priced at API list rates, August 2026
The data behind this chart
[
  {
    "label": "Opus 5",
    "input_usd_per_mtok": 5,
    "cache_read_usd_per_mtok": 0.5,
    "output_usd_per_mtok": 25,
    "afternoon_usd": 5.65
  },
  {
    "label": "Sonnet 5",
    "input_usd_per_mtok": 2,
    "cache_read_usd_per_mtok": 0.2,
    "output_usd_per_mtok": 10,
    "afternoon_usd": 2.26
  },
  {
    "label": "Haiku 4.5",
    "input_usd_per_mtok": 1,
    "cache_read_usd_per_mtok": 0.1,
    "output_usd_per_mtok": 5,
    "afternoon_usd": 1.13
  }
]

同一个下午,在 Opus 5 上的费用为 $5.65,在 Haiku 4.5 上为 $1.13。总费用主要由输出 token 决定:Opus 5 的输出费率为每 million 个 token $25,Haiku 4.5 为 $5;Claude 写出的 150,000 个 token,费用高于它读取的 2 million 个 token。这就是降低思考预算比减少文件更节省费用的原因。如果你要决定支付给哪家提供商,而不是选择运行哪个模型,请查看在 Claude 和 ChatGPT API 上计算三个任务的费用,了解哪一方的账单更低。

需要注意一个日期。Sonnet 5 在 31 August 2026 前采用每 million 个输入和输出 token 分别 $2 和 $10 的首发价格,并于 1 September 2026 起调整为 $3 和 $15。这会使同一个下午的费用从 $2.26 增加到约 $3.39。

每个下午费用的计算方法

Opus 5:200,000 个未缓存输入 token,费率为每 million 个 token $5,费用为 $1.00。1.8 million 个缓存读取 token 按输入费率的十分之一计费,费用为 $0.90。150,000 个输出 token,费率为每 million 个 token $25,费用为 $3.75。总计 $5.65。

Sonnet 5:未缓存输入费用 $0.40,缓存读取费用 $0.36,输出费用 $1.50。总计 $2.26。

Haiku 4.5:未缓存输入费用 $0.20,缓存读取费用 $0.18,输出费用 $0.75。总计 $1.13。

所有 3 行都假设 token 数量相同,因此它们之间的差额完全来自价格。实际费用会因上下文中有多少内容保持缓存而变化。

作为参考,Anthropic 自己的文档显示,截至 August 2026,企业部署中 Claude Code 的平均费用接近每位开发者每个活跃日 $13;90% 的用户每个活跃日费用低于 $30。按 token 计费并不一定比订阅便宜。它适合负载波动较大的情况,因为空闲日不会产生费用;如果你每天工作,则可能不如订阅划算。API 与订阅的实际费用对比给出了两者的成本交叉点。

在 VPS 上运行通宵长任务

有些任务不需要您持续查看,例如大型重构、测试迁移和文档全面检查。这些任务也不需要占用您的订阅配额。将任务放到配有 API key 的 VPS(虚拟专用服务器)上运行,费用按 token 用量计费,您的套餐配额可以留给明天的交互式工作。

在 Ubuntu 服务器上安装 Claude Code,并确认它可以运行:

curl -fsSL https://claude.ai/install.sh | bash
claude --version

claude --version 应输出类似 2.1.211 (Claude Code) 的版本字符串。此处的 command not found 表示 ~/.local/bin 尚未位于您的 PATH 中,因此请打开新的 shell 后重试。Linux 桌面上的安装方式也是使用同一个安装程序;在桌面环境中,CLI 与 beta 桌面应用和编辑器插件并列安装。

将 key 保存到文件中,而不是让它出现在 shell 历史记录里。在编辑器中创建 ~/.claude-env,写入一行 export ANTHROPIC_API_KEY=sk-ant-your-key-here,然后限制文件权限并加载它:

chmod 600 ~/.claude-env
. ~/.claude-env
printenv ANTHROPIC_API_KEY | cut -c1-10

最后一行会输出前 10 个字符。这样可以确认变量已设置,同时不会在屏幕上显示完整 key。

现在在 tmux 中启动任务,使其不受笔记本电脑合盖影响:

tmux new -s overnight
claude --bare -p "Convert every test under ./tests from unittest to pytest, run the suite, and fix what fails" \
  --allowedTools "Read,Edit,Bash" \
  --append-system-prompt-file ./CLAUDE.md \
  --output-format json > ~/overnight.json

按 Ctrl-b,然后按 d 脱离 tmux,接着关闭连接。稍后使用 tmux attach -t overnight 重新连接。VPS 上 tmux 会话中的 Claude Code 详细介绍了会话管理。

这里 --bare 很重要。它会跳过 hooks、skills、plugins 和 CLAUDE.md 的自动发现,并且不会读取 OAuth 凭据,因此运行过程只使用 API key。这样可以确保任务不会使用您的订阅。代价是项目规则也不会加载,因此 --append-system-prompt-file 会有意将这些规则重新传入。如果没有 --bare,设置 ANTHROPIC_API_KEY 后会触发一次性审批提示,而无人值守的运行无法回答该提示。

早上查看 JSON 中的结果和费用:

jq -r '.result' ~/overnight.json
jq -r '.total_cost_usd' ~/overnight.json

Claude Code 成功时退出状态为 0,运行失败时退出状态为非 0。因此,包装脚本可以根据退出状态进行分支,并通过邮件通知您失败情况。在离开前,请在 Claude Console 中设置工作区支出上限:凌晨 3am 处于重试循环中的 agent 可能会产生实际费用。若还希望降低运行速度,可以调低 CLAUDE_CODE_MAX_TOOL_USE_CONCURRENCY。无人值守运行 agent 的费用控制介绍了应优先设置的限制。

为任务创建单独的非特权用户,并使用单独的 git 分支。无人值守编辑代码库的 agent 偶尔会执行您本来会阻止的操作;使用分支后,这类问题会成为 git checkout,而不是事故。在 VPS 上安全运行编码 agent介绍了隔离方法。

对于完全不需要交互的批量工作,例如为数千条记录分类,Batch API 会异步处理请求,并对输入和输出 token 均提供 50% 的折扣。这是 Anthropic 公布的最低单 token 费用方案,而通宵运行所需的延迟正好符合它的处理方式。

哪些操作无法恢复访问权限

只有时间流逝才能恢复您的使用额度,因此,仔细检查后,所有据称可以重置 Claude 使用限额的方法都会失效。

开始新对话不会恢复您的使用额度。用量计入您的账户,而不是某个对话。这样做确实会让后续每条消息的成本降低,因为新对话无需重新读取历史记录,因此仍然值得采用。它只能降低成本,不能重置额度。

删除旧对话不会退还任何额度。相关令牌在处理时就已经消耗。

在会话或每周消息用量达到限制后切换模型不会产生任何作用,因为这些时间窗口由所有模型共享。只有明确指定模型的消息才会响应 /model。

循环重试只会让终端持续忙碌,不会解决问题。消息中显示的重置时间才是准确答案,/usage 会显示相同的时间,而不会显示错误。

升级确实会提高上限。因此,付费后额度仍未变化时,请先排查为什么新套餐仍可能保留旧限制,再判断是否是额度异常。

FAQ

我的 Claude 限额何时重置?

消息中会告知您。会话限额按连续 5 小时的窗口计算,消息会显示具体时间,例如 resets 3:45pm。每周限额会在分配给您账户的每周固定时间重置,消息会显示日期,例如 resets Mon 12:00am。在达到任一限额前,您可以在 Claude Code 中运行 /usage,或在 claude.ai 中依次打开 Settings 和 Usage,查看两条进度条及各自的重置时间。

切换到 Sonnet 后,我可以继续工作吗?

只有消息中明确指出某个模型时才可以。在 You've hit your Opus limit 后,运行 /model,选择其他模型,会话会保留当前上下文并继续运行。在 You've hit your session limit 或 You've hit your weekly limit 后,选择模型没有作用,因为这些窗口会合并计算所有模型的用量。在达到限额前切换到更便宜的模型,才是真正延长窗口的方法。

新建聊天会重置我的用量限额吗?

不会。用量按账户计算,因此新聊天仍使用同一个剩余额度。新聊天确实会降低后续每条消息的成本,因为新会话不包含需要 Claude 重新读取的历史记录。在 Claude Code 中,/clear 也会执行相同操作,且不产生费用;而 /compact 必须读取它要汇总的对话,因此压缩一个非常大的会话本身就是一次昂贵的请求。

API 比升级套餐便宜吗?

这取决于您的用量是否稳定。本页示例中的一个下午按 August 2026 的目录价格计算,使用 Sonnet 5 的费用为 $2.26,使用 Haiku 4.5 的费用为 $1.13。订阅按固定费用提供有上限的额度,因此您在大多数工作日使用时更划算。按 token 计费则适合用量波动较大的情况,因为完全不使用的日期不会产生费用。

我可以在等待限额重置期间继续运行任务吗?

可以,但需要将任务移出您的订阅。将其运行在 VPS 上,并在环境中设置 ANTHROPIC_API_KEY;这样费用按 token 计收,而不是消耗套餐窗口,二者不会相互竞争。在 tmux 中运行 claude --bare -p,即使您合上笔记本电脑,任务也会继续运行;--output-format json 会写入一个 total_cost_usd 字段,您可以在早上使用 jq 检查该字段。