Claude API có gói miễn phí không? Giải đáp chi tiết
Claude API không có gói miễn phí vĩnh viễn. Bạn chỉ nhận được một lượng credit nhỏ khi đăng ký. Bài viết cập nhật bảng giá tháng 7/2026 và cách tính chi phí cho ứng dụng đầu tiên.
Claude API có gói miễn phí không?
Claude API không có gói miễn phí. Không có hạn mức token miễn phí hàng tháng và không có gói cước nào cho phép bạn sử dụng với giá 0 USD. Tài khoản mới chỉ nhận được một lượng credit miễn phí nhỏ để kiểm thử API, và Anthropic không công bố con số cụ thể này. Sau khi dùng hết số credit đó, mọi yêu cầu gửi đi sẽ trừ vào số dư mà bạn đã thanh toán.
Đó là câu trả lời trực tiếp. Phần còn lại của hướng dẫn này sẽ giải thích các hệ quả từ thực tế đó: những phần nào của nền tảng hoàn toàn miễn phí, tại sao đây là vấn đề khác biệt so với gói miễn phí trên các ứng dụng Claude, và cách thức trung thực, tiết kiệm nhất để chạy chương trình đầu tiên của bạn.
Những gì miễn phí trên tài khoản Claude API
Một vài thành phần của nền tảng không tính phí token, và chúng quan trọng hơn vẻ ngoài của chúng.
- Đếm token. Endpoint đếm token được sử dụng miễn phí. Nó có giới hạn requests-per-minute riêng, tách biệt với việc tạo tin nhắn, vì vậy việc đo lường một prompt không bao giờ làm tiêu tốn ngân sách để gửi nó.
- Bản thân Console. Việc tạo tổ chức, đọc trang sử dụng và mở Workbench không tốn phí. Việc chạy một prompt trong Workbench là một API request thông thường, nên phần đó sẽ tính phí token như bất kỳ lệnh gọi nào khác.
- Thao tác với tệp. Việc tải lên, liệt kê và xóa tệp thông qua Files API là miễn phí. Bạn chỉ trả phí khi nội dung của tệp đi vào một request dưới dạng input tokens.
- Web fetch. Công cụ web fetch không tính thêm phí ngoài số token của bất kỳ nội dung nào nó kéo vào cuộc hội thoại. Web search không miễn phí: mức phí là $10 cho mỗi 1.000 lượt tìm kiếm tính đến tháng 7 năm 2026.
- Thực thi mã, đến một giới hạn nhất định. Mỗi tổ chức nhận được 1.550 giờ container miễn phí mỗi tháng tính đến tháng 7 năm 2026, sau đó là $0.05 mỗi giờ cho mỗi container. Việc thực thi mã không tốn thêm phí khi nó chạy cùng với web search hoặc web fetch.
Không có điều nào trong số đó là gói miễn phí (free tier). Điều này có nghĩa là việc đo lường rất minh bạch: bạn bị tính phí cho inference, chứ không phải cho các hạ tầng kỹ thuật xung quanh nó.
Tính giá cho một prompt trước khi thanh toán
Vì việc đếm token là miễn phí, bạn có thể biết chính xác kích thước của một request trước. Đây là cùng một endpoint mà các SDK sử dụng, và nó nhận cùng phần thân (body) như một tin nhắn thực tế.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-4-5",
"system": "You are a scientist",
"messages": [{"role": "user", "content": "Hello, Claude"}]
}'Một phản hồi hợp lệ là một dòng JSON: {"input_tokens": 14}. Hãy nhân con số đó với mức phí đầu vào của model, bạn sẽ biết chi phí của request trước khi gửi đi. Nếu bạn nhận được HTTP 401 kèm theo authentication_error, nghĩa là key bị sai hoặc đã bị thu hồi. Việc đếm token vẫn hoạt động ngay cả trên tài khoản không còn số dư, vì không có nội dung nào được tạo ra.
Tại sao đây là câu hỏi khác với gói miễn phí trong các ứng dụng
Mọi người tìm kiếm cả hai, và hai thứ này gần như không liên quan gì đến nhau. Gói miễn phí trên các ứng dụng Claude là một sản phẩm thực tế mà bạn có thể sử dụng trong thời gian dài mà không cần thẻ, được đo lường theo cửa sổ sử dụng luân phiên, và những gì gói miễn phí Claude thực sự bao gồm đề cập đến các tính năng đi kèm và thời điểm đặt lại hạn mức. API là dịch vụ đo lường trả trước và không có gói tương tự như vậy.
Hệ quả khiến nhiều người nhầm lẫn là gói đăng ký và API key là hai ví tiền riêng biệt. Việc trả phí cho Pro không nạp tiền vào API key, và các khoản tín dụng API không làm tăng hạn mức chat của bạn. Nếu bạn đang phải chọn giữa hai phương án thay vì cố gắng không trả phí, chi phí API Claude so với gói đăng ký sẽ giúp bạn tính toán dựa trên khối lượng công việc thực tế.
Chi phí cho một request sau khi hết credit
Đây là bảng giá API chính thức tính đến tháng 7 năm 2026, áp dụng cho mỗi triệu token.
The data behind this chart
[
{
"label": "Haiku 4.5",
"input_usd": 1,
"output_usd": 5
},
{
"label": "Sonnet 5, intro rate",
"input_usd": 2,
"output_usd": 10
},
{
"label": "Opus 5",
"input_usd": 5,
"output_usd": 25
}
]Haiku 4.5 tính phí 1 đô la cho mỗi triệu input token và 5 đô la cho mỗi triệu output token. Opus 5 tính phí 5 và 25 cho cùng khối lượng, vì vậy model bạn chọn làm thay đổi hóa đơn gấp 5 lần trước khi thực hiện bất kỳ tinh chỉnh prompt nào. Con số của Sonnet 5 là mức giá ưu đãi áp dụng đến ngày 31 tháng 8 năm 2026, sau đó giá sẽ quay về mức 3 đô la và 15 đô la. Chi phí output đắt gấp năm lần chi phí input trên tất cả các model này, đây là thông tin hữu ích nhất trên trang này: một câu trả lời dài dòng sẽ đắt hơn một câu hỏi dài. bạn nên sử dụng model Claude nào so sánh chúng dựa trên một công việc thực tế.
Các lộ trình thực tế tiết kiệm nhất để thử nghiệm
Bốn đòn bẩy thực hiện gần như toàn bộ công việc và không cái nào trong số đó cần giảm giá.
- Bắt đầu với model nhỏ nhất vượt qua bài kiểm tra của bạn. Phân loại, trích xuất, gắn thẻ và định tuyến hiếm khi cần một frontier model. Haiku 4.5 có giá bằng một phần năm Opus 5 và phản hồi nhanh hơn.
- Giới hạn
max_tokens. Đây là mức trần cứng cho các token được tạo ra, và đầu ra là phần đắt đỏ. Một bộ phân loại chỉ trả lời bằng một từ không nên mang ngân sách 16,000 token. - Cache phần prompt không bao giờ thay đổi. Đọc từ cache tốn 10% giá đầu vào cơ bản và ghi cache năm phút tốn 1.25x, vì vậy việc cache sẽ tự hoàn vốn sau một lần đọc duy nhất. Caching là khớp tiền tố, nghĩa là văn bản cố định phải đứng trước và câu hỏi thay đổi đứng sau, nếu không sẽ không có gì khớp và bạn phải trả phí ghi vô ích.
- Batch mọi thứ không mang tính tương tác. Message Batches API giảm giá 50% cho cả đầu vào và đầu ra, và hầu hết các batch hoàn thành trong vòng một giờ. Các công việc chạy đêm, backfill và chạy đánh giá nên thuộc về phần này.
Chi phí thực tế cho một ứng dụng nhỏ đầu tiên
Hãy lấy ví dụ một script tóm tắt log: 1.000 yêu cầu, mỗi yêu cầu gửi khoảng 800 input token chứa các dòng log và nhận về khoảng 200 token tóm tắt. Tổng cộng là 800.000 input token và 200.000 output token trên Haiku 4.5.
The data behind this chart
[
{
"label": "Standard rates",
"cost_usd": "1.80"
},
{
"label": "Same job on the Batch API",
"cost_usd": "0.90"
}
]Phép tính là 0,8 triệu input token với giá $1 cộng với 0,2 triệu output token với giá $5, tổng cộng là 1.80 đô la. Nếu gửi dưới dạng batch, cùng khối lượng công việc đó sẽ tốn 0.90. Số dư tín dụng khởi đầu đủ để thực hiện rất nhiều thử nghiệm ở quy mô này, đó là lý do tại sao việc thiếu gói miễn phí chỉ gây ảnh hưởng sau này hơn nhiều so với dự đoán của mọi người. Để xem hướng dẫn đầy đủ trên server của riêng bạn, xây dựng ứng dụng Claude API đầu tiên trên VPS sẽ bao gồm cách xử lý key, streaming và các luồng lỗi.
Các bậc sử dụng là giới hạn trần, không phải hạn mức được cấp
API tự động xếp mỗi tổ chức vào một bậc sử dụng dựa trên lịch sử sử dụng và trạng thái tài khoản. Các bậc này có tên là Start, Build, Scale và Custom, mỗi bậc thiết lập các giới hạn tốc độ (rate limit) cùng với mức chi tiêu tối đa hàng tháng. Tính đến tháng 7 năm 2026, các mức trần này là 500 USD cho Start, 1.000 USD cho Build và 200.000 USD cho Scale, còn bậc Custom không có giới hạn.
Hãy hiểu đây là một ngưỡng giới hạn thay vì một khoản tiền được cấp. Việc nằm trong bậc Start không có nghĩa là bạn có 500 USD để chi tiêu. Nó có nghĩa là bạn không được phép chi tiêu quá 500 USD trong một tháng dương lịch trước khi việc sử dụng bị tạm dừng cho đến tháng tiếp theo. Bạn cũng có thể tự thiết lập giới hạn chi tiêu thấp hơn mức trần của bậc, đây là việc đầu tiên cần làm đối với bất kỳ tài khoản nào có gắn thẻ thanh toán, vì một vòng lặp chạy mất kiểm soát là nguyên nhân phổ biến gây mất tiền hơn nhiều so với giá theo mỗi token.
Phải làm gì nếu yêu cầu bắt buộc là miễn phí
Nếu ngân sách thực sự bằng không và phải duy trì ở mức đó, API không phải là công cụ phù hợp, và việc tìm kiếm các gói dịch vụ khác cũng không thay đổi được điều này. Chỉ còn lại hai lựa chọn trung thực. Sử dụng gói miễn phí trong các ứng dụng Claude cho công việc tương tác, chấp nhận rằng nó bị giới hạn bởi cửa sổ ngữ cảnh và không cung cấp cho bạn endpoint có thể lập trình. Hoặc chạy một mô hình open-weights trên phần cứng bạn thuê, việc này thay thế hóa đơn theo token bằng hóa đơn máy chủ mà bạn kiểm soát: chạy Ollama trên VPS để tự host LLM đề cập đến bộ nhớ cần thiết cho mỗi kích thước mô hình và những gì các mô hình nhỏ thực sự có thể làm.
Đối với bất kỳ trường hợp nào ở giữa, câu trả lời thực tế là một key đã được nạp tiền, giới hạn chi tiêu thấp, mô hình nhỏ và bật tính năng prompt caching ngay từ ngày đầu tiên.
FAQ
Claude API có miễn phí không?
Không. Không có gói miễn phí và không có hạn mức token miễn phí hàng tháng. Tài khoản mới nhận được một lượng credit nhỏ để thử nghiệm API, sau đó mọi yêu cầu sẽ trừ vào credit trả trước hoặc thẻ thanh toán đã lưu. Một số phần của nền tảng không tính phí, bao gồm đếm token, tải lên và xóa tệp, và công cụ web fetch (ngoài số token của nội dung được lấy về).
Tôi có nhận được credit miễn phí khi đăng ký Claude API không?
Có, một lượng nhỏ, và Anthropic không công bố con số cụ thể. Hãy coi đó là đủ để kiểm tra xem tích hợp của bạn có hoạt động hay không, thay vì coi đó là ngân sách để phát triển. Credit dùng thử mở rộng cho đánh giá doanh nghiệp được sắp xếp thông qua bộ phận kinh doanh của Anthropic, không được cấp tự động.
Việc trả phí cho Claude Pro hoặc Max có bao gồm quyền truy cập API không?
Không. Gói đăng ký và API key được tính phí riêng biệt và theo các phương thức khác nhau. Pro và Max tăng hạn mức của bạn bên trong các ứng dụng Claude. API key trừ vào credit trả trước và bị giới hạn số lượng yêu cầu và số token mỗi phút. Nếu cần cả hai, bạn phải trả phí cho cả hai.
Cách rẻ nhất để thử nghiệm Claude API là gì?
Hãy đếm token trước, vì endpoint đó miễn phí. Sau đó, chạy thử nghiệm trên Haiku 4.5 với max_tokens được thiết lập chặt chẽ, cache mọi system prompt cố định để các lệnh gọi lặp lại chỉ tốn 10% giá đầu vào, và gửi mọi nội dung không mang tính tương tác thông qua Batch API với giá bằng một nửa. Với các thiết lập đó, một nghìn lệnh gọi nhỏ sẽ tốn hơn một đô la một chút tính đến tháng 7 năm 2026.