SSD Nodes Learn 🎉 VPS từ $5.50/tháng
Hướng dẫn Matt ConnorBởi Matt Connor · Cập nhật ngày 2026-08-21

Claude hết lượt gọi tool: cách tiếp tục tác vụ

Thông báo giới hạn tool trong lượt này không phải hết quota plan. Hiểu lỗi, giới hạn số vòng agent loop và cách yêu cầu Claude tiếp tục tác vụ.

Ý nghĩa của giới hạn sử dụng tool trong lượt này

Giới hạn sử dụng tool trong một lượt có nghĩa là Claude đã dừng giữa chừng vì một response đã dùng hết số lần gọi tool được phép. Điều này không có nghĩa là tài khoản của bạn đã hết hạn mức sử dụng. Mọi thông tin Claude đã tìm được trước khi dừng vẫn còn trong cuộc hội thoại. Hãy gửi thêm một message yêu cầu Claude tiếp tục. Claude sẽ mở một lượt mới với hạn mức mới.

Một lượt là một vòng trao đổi trong agent loop. Claude tạo output có các tool call, client chạy các tool đó, rồi kết quả được gửi lại cho Claude để quyết định bước tiếp theo. Chu trình này lặp lại mà không chuyển quyền điều khiển lại cho bạn. Lượt kết thúc khi Claude tạo một response không chứa tool call. Giới hạn của lượt là giới hạn số vòng trao đổi mà một answer được phép thực hiện.

Giới hạn sử dụng của plan là một cơ chế kiểm soát riêng

Giới hạn của plan tính lượng bạn đã sử dụng trong một khoảng thời gian. Trang trợ giúp của Anthropic về các thông báo lỗi, được kiểm tra vào ngày 18 August 2026, cho biết thông báo đó là Approaching 5-hour limit. khi bạn sắp chạm giới hạn và 5-hour limit reached - resets [time]. sau khi vượt qua giới hạn. Thông báo có nêu một thời điểm. Chờ đến thời điểm đó sẽ khắc phục lỗi; mọi nội dung bạn nhập trong lúc chờ đều không giúp ích.

Thông báo yêu cầu sử dụng tool hoạt động theo cách ngược lại. Nó xuất hiện giữa một task, và chỉ cần một tin nhắn follow-up là công việc có thể tiếp tục ngay. Quota còn lại của bạn không bị ảnh hưởng. Đây là phép thử cần thực hiện: nếu chờ không có tác dụng nhưng tiếp tục thì hoạt động, bạn chưa hề chạm quota. Với trường hợp quota, cần làm gì khi Claude báo đã đạt giới hạn liệt kê các tùy chọn, còn cách tính giới hạn sử dụng Claude giải thích các khoảng thời gian áp dụng cho những giới hạn đó.

Tại sao một lượt lại có giới hạn tool

Mỗi lần gọi tool đều tiêu tốn context. Lệnh gọi được gửi đi, tool chạy, rồi toàn bộ kết quả được đưa trở lại cuộc hội thoại. Đọc một file lớn hoặc chạy một command có output dài có thể dùng đến hàng nghìn token chỉ trong một bước, và phần văn bản đó vẫn nằm trong context trong suốt phần còn lại của session. Tài liệu về vòng lặp agent của Anthropic nêu rõ hệ quả: context tích lũy qua các lượt, nên một session có nhiều lần gọi tool sẽ mang theo nhiều dữ liệu hơn hẳn một session ngắn.

Giới hạn cho mỗi lượt sẽ dừng một vòng lặp không còn tạo ra tiến triển. Một agent tìm kiếm, đọc, tìm kiếm lại nhưng vẫn không tìm thấy gì sẽ tiếp tục làm như vậy cho đến khi có thứ gì đó ngắt nó. Giới hạn này chính là điểm ngắt. Nó trả quyền điều khiển cho bạn tại thời điểm bạn có thể định hướng lại công việc. Cách này tốn ít hơn nhiều so với để vòng lặp chạy đến cuối context window.

Giới hạn này thể hiện ở đâu trong API

Tài liệu lỗi công khai của Anthropic không nêu số lần gọi tool tối đa cho mỗi lượt trong ứng dụng chat Claude. Vì vậy, mọi con số chính xác bạn đọc được về ứng dụng này đều chỉ là phỏng đoán. API (application programming interface) có tài liệu mô tả cùng dạng giới hạn này. Đây là nơi thể hiện hành vi thực tế.

Trường stop_reason trong response của Messages API cho biết vì sao quá trình tạo nội dung đã dừng. Các giá trị được ghi nhận là end_turn, max_tokens, stop_sequence, tool_use, pause_turn, refusalmodel_context_window_exceeded. Hai giá trị trong số đó mô tả tình huống trong hướng dẫn này.

pause_turn được trả về khi vòng lặp sampling phía server đạt đến giới hạn số lần lặp trong lúc chạy các tool phía server như web search. Tính đến ngày 18 August 2026, trang về lý do dừng xử lý đặt giá trị mặc định là 10 lần lặp cho mỗi request. Cách khắc phục được tài liệu hướng dẫn là gửi lại response không thay đổi dưới dạng assistant message để Claude tiếp tục từ điểm đã tạm dừng. Đây là phiên bản API của việc nhập "continue" trong cửa sổ chat.

max_tokens có nghĩa là response đã chạm đến giới hạn output token được đặt trong request. Nếu response bị cắt giữa một block tool use chưa hoàn chỉnh, tool call không thể được thực thi. Cách xử lý được tài liệu hướng dẫn là thử lại với max_tokens cao hơn.

Hãy xem các giá trị hiện tại trên trang về lý do dừng xử lý thay vì tin vào các giá trị được ghi ở đây. Giá trị mặc định trên trang đó có thể thay đổi. Một con số đã lỗi thời còn tệ hơn việc không có con số nào.

Điều gì khiến một chat dùng hết số lần gọi tool

  • Câu hỏi không có điểm dừng tự nhiên. “Tìm mọi nội dung đã viết về X” không cung cấp cho model thông tin để xác định khi nào việc tìm kiếm đã hoàn tất.
  • Đọc lặp lại cùng một tài liệu vì câu trả lời không nằm ở vị trí model dự đoán.
  • Kết quả từ tool quá lớn. Một trang web dài hoặc một file lớn có thể chiếm hết dung lượng cần thiết cho phần còn lại của lượt xử lý.
  • Nhiều tác vụ độc lập trong cùng một message. Mỗi tác vụ cần các lần gọi tool riêng, nhưng tất cả đều dùng chung một hạn mức.
  • Các connector và MCP (model context protocol) server không được dùng cho tác vụ này. Định nghĩa tool của chúng được nạp vào request và cung cấp cho model thêm nhiều cách để dùng hết lượt xử lý.

Cách hoàn tất câu trả lời

Trả lời bằng "continue", hoặc tốt hơn là một chỉ dẫn ngắn nêu rõ phần còn thiếu. Việc này mở một turn mới với budget mới. Toàn bộ conversation trước đó vẫn nằm trong context, nên Claude tiếp tục xử lý thay vì lặp lại các tool call đã thực hiện.

Nếu Claude dừng ở cùng một vị trí 2 lần, task quá rộng cho một turn. Hãy chia nhỏ task. Thay vì yêu cầu audit toàn bộ repository, trước tiên hãy yêu cầu liệt kê file, sau đó hỏi về từng file trong mỗi message. 4 turn nhỏ có thể hoàn tất công việc mà một turn lớn không thể.

Thu hẹp phạm vi mà model phải tìm kiếm. Cung cấp chính xác file path hoặc error string, rồi paste log nếu bạn đã có log đó. Paste log chỉ tốn 1 message. Để model tự tìm log sẽ tốn nhiều tool call hơn và model có thể tìm nhầm log.

Tắt các connector hiện không cần dùng. Mỗi tool được kết nối sẽ thêm phần định nghĩa của nó vào mọi request, làm tốn context và mở rộng tập hợp hành động mà model có thể chọn. Lý do tương tự cũng áp dụng cho một coding session dài, trong đó giữ context của một Claude Code session ở mức nhỏ là yếu tố quyết định agent hoàn tất công việc hay dừng giữa chừng.

Tự đặt giới hạn lượt chạy khi bạn chạy agent

Nếu bạn điều khiển Claude bằng code của mình, giới hạn cho mỗi lượt là thiết lập do bạn quản lý. Claude Agent SDK (bộ công cụ phát triển phần mềm) cung cấp max_turns trong Python và maxTurns trong TypeScript. Tài liệu mô tả đây là số round trip tối đa khi sử dụng tool. Mặc định được ghi trong tài liệu là không giới hạn.

Khi đạt đến giới hạn này, SDK trả về một kết quả có subtypeerror_max_turns. Với một lần gọi query() đơn lẻ, SDK sẽ phát sinh lỗi chứa chuỗi Reached maximum number of turns. Kết quả vẫn chứa num_turnssession_id, vì vậy bạn có thể tiếp tục đúng session đó với giới hạn cao hơn thay vì chạy lại task.

Từ CLI (giao diện dòng lệnh), thiết lập tương tự là một flag và chỉ áp dụng cho print mode:

claude -p --max-turns 3 "summarise the failing tests"

Tài liệu về flag cho biết CLI sẽ thoát với lỗi khi đạt giới hạn và mặc định không có giới hạn. Có một phiên bản tương tự dựa trên chi phí: max_budget_usd trong Python và maxBudgetUsd trong TypeScript sẽ dừng loop khi đạt ngưỡng chi tiêu thay vì số lượt chạy. Chi phí của subagent cũng được tính vào tổng này. Nếu bạn chạy agent trên một server tính phí theo tháng, kiểm soát chi phí của AI agent trên VPS là việc nên thiết lập trước lần chạy dài đầu tiên.

Việc tạm dừng để chờ phê duyệt là trường hợp khác. Nếu agent dừng lại và không phát sinh chi phí, hãy đọc permission_mode thay vì kiểm tra số lượt chạy, vì một tool đang chờ câu trả lời của người dùng nhưng không nhận được. chế độ tự động và thiết lập quyền của Claude Code giải thích mode nào yêu cầu xác nhận và mode nào chạy mà không hỏi.

Cách tự kiểm tra hành vi hiện tại

Hành vi ở đây có thể thay đổi mà không có thông báo, vì vậy hãy xem mọi con số trong hướng dẫn này là thông tin tại một thời điểm, không phải giá trị cố định. Có hai nơi cho biết thông tin nào đang đúng.

  • Tài liệu API về lý do dừng, trong đó nêu giá trị mặc định của số vòng lặp công cụ phía server và cách tiếp tục sau khi đạt giới hạn.
  • Trang help centre của Anthropic về thông báo lỗi, trong đó liệt kê cách diễn đạt về giới hạn sử dụng. Được kiểm tra vào ngày 18 August 2026, trang này ghi lại thông báo về giới hạn sử dụng trong năm giờ và theo tuần, nhưng không đề cập đến giới hạn tool cho mỗi lượt. Vì vậy, phần này không trích dẫn con số chính thức nào cho ứng dụng chat.

Thay vào đó, hãy đo các lần chạy của chính bạn. Trong Claude Code, /context hiển thị mức sử dụng context hiện tại dưới dạng lưới màu và chỉ ra những tool đang chiếm nhiều context nhất, còn /compact tóm tắt cuộc hội thoại đến thời điểm hiện tại để giải phóng dung lượng. Trong Agent SDK, mỗi result đều có num_turns, nhờ đó bạn có thể biết một task thông thường thực sự cần bao nhiêu lượt trao đổi trước khi đặt giới hạn. Con số từ workload của chính bạn có giá trị hơn con số trong một bài đăng trên forum.

FAQ

Giới hạn sử dụng tool có giống giới hạn sử dụng Claude của tôi không?

Không. Giới hạn sử dụng tính tổng mức bạn đã dùng trong một khoảng thời gian và cho biết thời điểm reset, nên cách xử lý là chờ. Thông báo giới hạn sử dụng tool dừng một response giữa chừng vì response đó đã dùng hết số lần gọi tool, còn việc gửi message khác sẽ bắt đầu turn mới với budget mới ngay lập tức. Nếu việc tiếp tục hoạt động ngay, quota của bạn chưa bao giờ là vấn đề. cách tính giới hạn sử dụng Claude giải thích đầy đủ trường hợp quota.

Làm cách nào để Claude hoàn thành task đã dừng giữa chừng?

Gửi thêm một message. "Continue" có tác dụng, nhưng chỉ dẫn nêu rõ phần còn thiếu sẽ hiệu quả hơn vì giúp model không phải dựng lại context mà nó đã có. Nếu lần thứ hai nó vẫn dừng tại cùng một điểm, hãy chia task thành các phần nhỏ hơn và gửi mỗi message một phần. Cung cấp chính xác file path hoặc dán trực tiếp nội dung sẽ loại bỏ bước tìm kiếm đã tiêu tốn budget ngay từ đầu.

"límite de uso de herramientas" hoặc "limite de uso de ferramentas" nghĩa là gì?

Đây là cách viết bằng tiếng Tây Ban Nha và tiếng Bồ Đào Nha cho cùng một thông báo, thường xuất hiện dưới dạng "límite de uso de herramientas en este turno" hoặc "limite de uso de ferramentas neste turno". Ý nghĩa giống nhau trong mọi ngôn ngữ: Claude đã dùng hết số lần gọi tool được phép trong một response, và quota của plan không liên quan. Cách xử lý cũng giống nhau. Hãy reply yêu cầu nó tiếp tục, hoặc chia request thành các bước nhỏ hơn. Giới hạn billing là một thông báo riêng và thông báo đó cho biết thời điểm reset.

Nâng cấp plan có tăng giới hạn sử dụng tool trong một turn không?

Cấp độ plan và tool budget cho mỗi turn là 2 cơ chế kiểm soát khác nhau. Nâng cấp plan tăng mức bạn có thể sử dụng trong một khoảng thời gian; đây là giới hạn có nêu thời điểm reset. Số lần gọi tool mà một response được phép thực hiện là thuộc tính của loop chạy model, và Anthropic không công bố con số đó cho chat app. Chia task thành các turn nhỏ hơn mới là cách thực sự hữu ích, bất kể plan nào.

Vì sao agent của tôi dừng sau chỉ vài lần gọi tool?

Kiểm tra xem bạn có đặt giới hạn hay không. Claude Agent SDK dùng max_turns trong Python và maxTurns trong TypeScript, còn command line interface dùng --max-turns ở print mode. Khi đạt một trong các giới hạn đó, SDK trả về result có subtypeerror_max_turns và một error chứa đoạn text Reached maximum number of turns. Mặc định của cả 2 tùy chọn là không giới hạn. Nếu không có giới hạn nào được đặt mà run vẫn dừng, hãy đọc stop_reason trong result: max_tokens nghĩa là đã chạm giới hạn output, còn pause_turn nghĩa là server tool loop đã đạt giới hạn iteration và muốn response được gửi lại để có thể tiếp tục.