SSD Nodes Learn Hosting plans →
Hướng dẫn Matt ConnorBởi Matt Connor

Giới hạn tải tệp của Claude và cái giá phải trả

Claude nhận tệp tới 500 MB và tối đa 20 tệp mỗi cuộc trò chuyện, nhưng một PDF dài bị gửi lại ở mỗi lượt. Đây là các trần thực tế và cách giảm chi phí token.

Giới hạn tải tệp của Claude, kiểm tra ngày 28/09/2026

Giới hạn tải tệp của Claude có hai tầng, và phần lớn người dùng chỉ để ý tầng thứ nhất. Trong một cuộc trò chuyện, bạn đính kèm được tối đa 20 tệp, mỗi tệp tới 500 MB. Trong phần kiến thức (knowledge) của một Project, mỗi tệp tối đa 30 MB, số lượng tệp không bị chặn, nhưng toàn bộ nội dung phải vừa cửa sổ ngữ cảnh.

Tầng thứ hai mới là thứ làm bạn hết lượt sớm. Một tài liệu dài không chỉ cần lọt qua cửa đúng một lần. Nó được gửi lại làm ngữ cảnh ở mọi lượt hỏi sau đó, nên nó là một khoản chi lặp lại chứ không phải khoản chi một lần.

Mọi con số trong bài lấy từ trung tâm trợ giúp và tài liệu API của Anthropic, kiểm tra ngày 28/09/2026. Anthropic có sửa các mức này theo thời gian. Nếu bạn đọc bài sau ngày đó, hãy mở lại trang trợ giúp và đối chiếu trước khi lên kế hoạch cho một tài liệu lớn.

Bốn trần cứng cần nhớ:

  • Tệp đính kèm trong chat: tối đa 500 MB mỗi tệp, tối đa 20 tệp trong một cuộc trò chuyện.
  • Tệp trong Project knowledge: tối đa 30 MB mỗi tệp, không giới hạn số lượng tệp.
  • Ảnh: tối đa 8000x8000 pixel.
  • PDF: tối đa 1000 trang cho một tệp tải lên.

Định dạng nào được đọc thành văn bản, định dạng nào được đọc như ảnh

Claude xử lý tệp theo hai đường khác nhau, và đường nào được chọn quyết định bạn tốn bao nhiêu token (đơn vị nhỏ mà mô hình đếm để tính mức dùng).

Nhóm được trích xuất thành văn bản: PDF, DOCX, CSV, TXT, HTML, ODT, RTF, EPUB và JSON. Riêng XLSX cần bật công cụ chạy mã (code execution) thì Claude mới mở được.

Nhóm được xem như hình ảnh: JPEG, PNG, GIF và WebP. Ảnh luôn tốn token theo kích thước điểm ảnh, không theo số chữ nằm trong ảnh.

PDF nằm giữa hai nhóm, và đây là chỗ hay gây bất ngờ. Với tệp từ 1 đến 100 trang, Claude đọc cả phần văn bản lẫn hình ảnh của từng trang, nên nó nhìn được biểu đồ và bố cục. Từ trang thứ 101 đến 1000, Claude chỉ đọc phần văn bản, vì vậy biểu đồ và sơ đồ bị bỏ qua. Quá 1000 trang thì tệp không tải lên được.

Hai quy tắc đó ghép lại tạo ra một lỗi thầm lặng. Một bản PDF scan 300 trang không có lớp văn bản, chỉ có ảnh chụp từng trang. Vì tài liệu vượt 100 trang nên Claude chỉ lấy phần văn bản, mà phần văn bản gần như rỗng, nên câu trả lời sẽ chung chung và không trích dẫn được gì. Cách kiểm tra rất nhanh: yêu cầu Claude chép lại nguyên văn câu đầu tiên ở trang 150. Nếu nó không chép được, tệp của bạn không có lớp văn bản, và bạn cần chạy OCR (nhận dạng ký tự quang học) trước khi tải lên.

Vì sao một tệp PDF có thể ngốn hết cửa sổ 5 giờ

Mức dùng của Claude trên gói trả phí được tính theo phiên 5 giờ, cộng thêm một hạn mức tuần. Bài điều gì thực sự ngốn hết giới hạn Claude Pro đã giải thích cơ chế đó, còn gói Claude Pro cho bạn bao nhiêu token mỗi phiên cho bạn con số để so sánh. Ở đây chỉ cần một điểm: tệp đính kèm nằm trong cùng một ngân sách với câu hỏi của bạn.

Tài liệu của Anthropic ghi rằng mỗi trang PDF thường dùng khoảng 1.500 đến 3.000 token cho phần văn bản, tùy mật độ chữ. Ngoài ra, vì mỗi trang còn được chuyển thành ảnh, phần ảnh được tính thêm theo cách tính token của ảnh. Nghĩa là con số dưới đây là mức sàn, không phải mức trần.

ChartƯớc tính token phần văn bản của một tệp PDF theo số trang, đơn vị nghìn token
The data behind this chart
[
  {
    "label": "PDF 10 trang",
    "token_thap_nghin": 15,
    "token_cao_nghin": 30
  },
  {
    "label": "PDF 50 trang",
    "token_thap_nghin": 75,
    "token_cao_nghin": 150
  },
  {
    "label": "PDF 120 trang",
    "token_thap_nghin": 180,
    "token_cao_nghin": 360
  },
  {
    "label": "PDF 300 trang",
    "token_thap_nghin": 450,
    "token_cao_nghin": 900
  }
]

Bảng trên là ước tính do chúng tôi suy ra từ khoảng 1.500 đến 3.000 token mỗi trang mà Anthropic công bố, chưa cộng token ảnh. Một hợp đồng 10 trang chỉ tốn khoảng 15 nghìn token, tức là không đáng kể. Một tài liệu 300 trang rơi vào khoảng 450 đến 900 nghìn token, và con số đó đã lớn hơn cửa sổ ngữ cảnh 200K của nhiều mô hình. Trên gói trả phí, mô hình mới nhất hỗ trợ cửa sổ tới 1 triệu token, các mô hình khác là 500K hoặc 200K.

Điểm quan trọng nhất nằm ở chữ "mỗi lượt". Khi bạn hỏi câu thứ hai trong cùng cuộc trò chuyện, tài liệu vẫn nằm trong ngữ cảnh. Hỏi mười câu về cùng một bản báo cáo thì bạn trả cho nội dung đó nhiều lần, chứ không phải một lần. Anthropic cũng nói thẳng rằng cuộc trò chuyện dài, khi chạm ngưỡng phải nén ngữ cảnh tự động, sẽ tiêu tốn thêm mức dùng. Đó là lý do cảnh báo mà bài đã dùng hết 90% phiên mô tả thường xuất hiện ngay sau khi bạn đính kèm một tệp lớn rồi hỏi tiếp vài câu.

Bốn cách giảm chi phí, xếp theo thứ tự nên thử

Thứ tự ở đây quan trọng. Ba cách đầu miễn phí và làm được ngay, cách thứ tư đổi mô hình tính tiền.

  1. Cắt hoặc tách tệp. Tách bản PDF 300 trang thành từng chương rồi chỉ tải chương liên quan. Chi phí giảm gần như tuyến tính theo số trang, vì token tính theo nội dung chứ không theo số tệp.
  2. Dán đúng đoạn cần hỏi. Nếu câu hỏi của bạn nằm ở điều khoản 7.2, hãy dán riêng điều khoản đó. Hai trang văn bản dán trực tiếp tốn vài nghìn token, trong khi cả tệp tốn hàng trăm nghìn.
  3. Đưa tài liệu tham chiếu ổn định vào Project knowledge. Anthropic ghi rằng tệp tải lên một Project được cache lại, và phần đã cache tính vào hạn mức ít hơn so với nội dung mới. Vậy nên tài liệu bạn hỏi đi hỏi lại hàng tuần, ví dụ bộ quy định nội bộ hay tài liệu sản phẩm, nên nằm trong Project thay vì đính kèm lại ở mỗi cuộc trò chuyện. Khi kiến thức của Project vượt cửa sổ ngữ cảnh, Claude tự chuyển sang chế độ RAG (truy hồi rồi sinh câu trả lời), mở rộng sức chứa tới khoảng mười lần, đổi lại Claude chỉ đọc phần được truy hồi chứ không đọc toàn bộ.
  4. Chuyển việc sang API. Khi bạn phải xử lý hàng trăm tài liệu, hạn mức theo phiên là sai công cụ. Trên API bạn trả tiền theo token đã dùng, không có cửa sổ 5 giờ nào chặn bạn giữa chừng. Bài so sánh chi phí API với gói thuê bao giúp bạn quyết định ngưỡng chuyển, còn token đầu vào và token đầu ra được tính tiền khác nhau ra sao giải thích vì sao tài liệu dài lại rẻ hơn bạn tưởng trên API: chúng gần như toàn bộ là token đầu vào.

Nếu bạn dùng Claude Code cho tài liệu trong kho mã, nguyên tắc vẫn vậy nhưng công cụ khác. Bài quản lý ngữ cảnh trong Claude Code nói về cùng một vấn đề ở phía dòng lệnh.

Giới hạn khi gọi API khác với trong ứng dụng chat

Đừng mang con số 500 MB sang API. Ở đó các trần hoàn toàn khác.

Một yêu cầu tới API có kích thước tối đa 32 MB, tính cả mọi nội dung gửi kèm. Số trang PDF tối đa cho một yêu cầu là 600 trang, và chỉ còn 100 trang khi cửa sổ ngữ cảnh của yêu cầu dưới 1 triệu token. Tài liệu cũng lưu ý rằng PDF dày đặc chữ nhỏ, bảng phức tạp hay nhiều đồ họa có thể lấp đầy cửa sổ ngữ cảnh trước khi chạm trần số trang.

Để tránh gửi tệp lớn trong mỗi yêu cầu, hãy tải tệp lên một lần qua Files API rồi tham chiếu bằng file_id:

curl -X POST https://api.anthropic.com/v1/files \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -F "file=@/path/to/document.pdf"

Phản hồi trả về một id dạng file_011CNha8iCJcU1wXNR6q4V8w. Bạn dùng lại id đó trong khối document của các yêu cầu sau. Files API cho phép 500 MB mỗi tệp và 1 TB tổng dung lượng cho mỗi tổ chức. Các thao tác tải lên, tải xuống, liệt kê và xóa đều miễn phí, nhưng nội dung tệp khi đưa vào một yêu cầu Messages vẫn được tính như token đầu vào. Nói cách khác, Files API tiết kiệm băng thông chứ không tiết kiệm token.

Một chi tiết dễ bỏ sót: tệp tải lên chỉ tự hết hạn nếu bạn khai báo expires_in_seconds ngay lúc tải, với giá trị từ 3600 giây đến 7776000 giây (90 ngày). Không khai báo thì tệp nằm đó cho tới khi bạn gọi lệnh xóa. Nếu bạn đang tính chi phí cho một tác nhân chạy nền, kiểm soát chi phí tác nhân AI trên VPS bàn kỹ phần dọn dẹp này.

Những lỗi bạn sẽ gặp, và nguyên nhân thật sự

Trong ứng dụng chat, thông báo lỗi thay đổi theo từng bản cập nhật giao diện, nên đừng tìm theo chữ. Hãy tìm theo nguyên nhân. Tệp bị từ chối ngay khi kéo thả thường là do vượt trần kích thước hoặc vượt 1000 trang. Tệp được nhận nhưng Claude trả lời mơ hồ thường là do không có lớp văn bản, hoặc do tài liệu vượt 100 trang nên phần hình ảnh bị bỏ qua. Cuộc trò chuyện đột ngột báo hết lượt thường là do tệp đã được gửi lại quá nhiều lượt, và khi Claude báo hết lượt thì nên làm gì liệt kê các bước xử lý.

Trên API thì ngược lại, lỗi có mã rõ ràng và bạn nên bắt theo mã. Tài liệu liệt kê 413 khi tệp vượt 500 MB, 400 khi tổ chức chạm trần 1 TB, 400 khi tệp lớn hơn cửa sổ ngữ cảnh, và 400 khi tên tệp không nằm trong khoảng 1 đến 255 ký tự hoặc chứa ký tự bị cấm. Lỗi trả về theo dạng này:

{
  "type": "error",
  "error": {
    "type": "not_found_error",
    "message": "File `file_011CNha8iCJcU1wXNR6q4V8w` not found."
  },
  "request_id": "req_011CQFYcrRp7mCHLDsAYT8Qt"
}

Hãy ghi lại request_id trong log của bạn. Đó là thứ duy nhất giúp đối chiếu khi cần hỏi bộ phận hỗ trợ.

Còn một điểm về quyền truy cập mà nhóm nhiều người hay bỏ qua: tệp tải lên qua Files API thuộc về cả workspace, không thuộc riêng một người dùng hay một phiên. Bất kỳ khóa API nào có quyền vào workspace đó đều đọc được mọi tệp trong đó. Nếu ứng dụng của bạn phục vụ nhiều khách hàng, mỗi khách hàng cần một workspace riêng, và không bao giờ nhận file_id do người dùng cuối gửi lên.

Tóm lại nên làm gì

Trần kích thước hiếm khi là thứ chặn bạn. Thứ chặn bạn là cùng một tài liệu được tính tiền lại ở mỗi lượt hỏi. Trước khi tải một tệp lớn, hãy hỏi: tôi sẽ hỏi bao nhiêu câu về tệp này. Một câu thì cứ tải cả tệp. Hai mươi câu thì hãy cắt tệp, hoặc đưa vào Project, hoặc chuyển hẳn sang API. Nếu bạn đang cân nhắc nâng cấp gói để có thêm chỗ, hãy xem mức chi thực tế cho Claude Pro tại Việt Nam và một triệu token của Claude đáng giá bao nhiêu trước, vì với khối lượng tài liệu lớn thì trả theo token thường rẻ hơn nâng gói.

FAQ

Claude cho tải tệp tối đa bao nhiêu MB?

Tính đến ngày 28/09/2026, tệp đính kèm trong một cuộc trò chuyện tối đa 500 MB, và mỗi cuộc trò chuyện nhận tối đa 20 tệp. Tệp đưa vào phần kiến thức của một Project thì chặt hơn: tối đa 30 MB mỗi tệp, nhưng không giới hạn số lượng tệp, miễn tổng nội dung vừa cửa sổ ngữ cảnh. Ảnh tối đa 8000x8000 pixel. PDF tối đa 1000 trang. Trên API thì khác hẳn: một yêu cầu tối đa 32 MB, còn Files API cho 500 MB mỗi tệp.

Vì sao Claude đọc được tệp PDF của tôi nhưng trả lời rất chung chung?

Hai nguyên nhân thường gặp. Thứ nhất, tệp vượt 100 trang, nên Claude chỉ lấy phần văn bản và bỏ qua hình ảnh từng trang, vì vậy mọi biểu đồ và sơ đồ đều biến mất. Thứ hai, tệp là bản scan không có lớp văn bản, nên phần trích xuất gần như rỗng. Kiểm tra bằng cách yêu cầu Claude chép nguyên văn một câu ở giữa tài liệu. Không chép được nghĩa là không có lớp văn bản, và bạn cần chạy OCR trước.

Đưa tệp vào Project có tiết kiệm hơn đính kèm lại mỗi lần không?

Có, với tài liệu ổn định mà bạn dùng nhiều lần. Anthropic ghi rằng tệp trong Project được cache, và phần đã cache tính vào hạn mức ít hơn nội dung mới. Đổi lại, mỗi tệp trong Project chỉ được tối đa 30 MB, và khi tổng kiến thức vượt cửa sổ ngữ cảnh thì Claude chuyển sang chế độ truy hồi, đọc phần liên quan thay vì đọc hết. Tệp dùng đúng một lần thì cứ đính kèm thẳng vào cuộc trò chuyện.

Tôi hết lượt ngay sau khi tải lên một tài liệu dài. Làm gì tiếp?

Đừng hỏi thêm trong chính cuộc trò chuyện đó, vì mỗi lượt mới lại kéo cả tài liệu vào ngữ cảnh một lần nữa. Mở cuộc trò chuyện mới, dán riêng phần nội dung bạn thực sự cần hỏi, rồi chờ phiên 5 giờ được đặt lại. Nếu việc này lặp lại hàng tuần, đó là dấu hiệu khối lượng của bạn đã vượt mô hình thuê bao, và nên chuyển phần xử lý tài liệu sang API tính theo token.