สาเหตุที่ทำให้โควตา Claude Pro หมดเร็วเกินกำหนด
Anthropic ไม่ระบุจำนวน token ที่ชัดเจนสำหรับผู้ใช้ Pro เรียนรู้ปัจจัยที่ทำให้โควตาหมดเร็ว ทั้งความยาวบทสนทนา ไฟล์แนบ รูปภาพ การใช้เครื่องมือ และระดับความพยายามในการประมวลผล
สิ่งที่ทำให้โควตา Claude Pro ของคุณหมดลง
Anthropic ไม่ได้ประกาศจำนวน token ที่อนุญาตสำหรับ Claude Pro ดังนั้นจึงไม่มีใครบอกคุณได้ว่าขีดจำกัดของคุณคือเท่าใดในหน่วยของ token แต่สิ่งที่ทำให้โควตาหมดลงนั้นเป็นสิ่งที่ทราบได้และมีประโยชน์มากกว่า ได้แก่ ความยาวของบทสนทนาเป็นอันดับแรก ตามด้วยไฟล์แนบและรูปภาพ จากนั้นคือการใช้ความพยายามในการคิด (thinking effort) และสุดท้ายคือการทำงานของเครื่องมือและเอเจนต์
Token คือส่วนหนึ่งของข้อความ โดยประมาณคือคำสั้นๆ หนึ่งคำหรือส่วนหนึ่งของคำที่ยาวกว่า ทุกคำขอที่คุณส่งจะถูกวัดผลเป็นจำนวน token และแผนการใช้งานของคุณจะนับจำนวนเหล่านี้ให้โดยอัตโนมัติในเบื้องหลัง หน้า แนวปฏิบัติที่ดีที่สุดสำหรับขีดจำกัดการใช้งาน ของ Anthropic ได้ระบุปัจจัยที่มีผลต่อการนับจำนวนดังกล่าวไว้ ได้แก่ ความยาวของข้อความ, ขนาดของไฟล์แนบ, ความยาวของบทสนทนาในปัจจุบัน, การใช้เครื่องมือ เช่น การวิจัยและการค้นหาบนเว็บ, การเลือกโมเดล, ระดับความพยายาม และการสร้าง artifact ทุกรายการในรายการนั้นทำหน้าที่เหมือนกัน แต่ละรายการส่งผลต่อจำนวน token ที่คำขอหนึ่งรายการต้องใช้
คำถามที่เกี่ยวข้องกันสองข้อมีหน้าอธิบายแยกต่างหาก แผน Pro ครอบคลุมการใช้งานเท่าใด ครอบคลุมถึงขนาดของโควตาและเหตุผลที่อธิบายเป็นจำนวนเซสชันแทนที่จะเป็นจำนวน token สิ่งที่ควรทำเมื่อใช้งานถึงขีดจำกัด ครอบคลุมถึงการกู้คืนการใช้งาน หน้าเว็บนี้ครอบคลุมถึงสาเหตุที่โควตาถูกใช้ไป
ทุกข้อความจะส่งประวัติการสนทนาทั้งหมดซ้ำอีกครั้ง
นี่คือกลไกที่ทำให้เกือบทุกคนประหลาดใจ โมเดลไม่มีหน่วยความจำระหว่างการโต้ตอบ ในการตอบข้อความถัดไปของคุณ โมเดลจะอ่านประวัติการสนทนาทั้งหมดใหม่อีกครั้งตั้งแต่คำแรก เอกสารของ Anthropic ระบุเรื่องนี้ไว้อย่างชัดเจนว่า: ทุกคำขอจะส่งประวัติการสนทนาทั้งหมดซ้ำไปใหม่
ดังนั้น ข้อความติดตามผลที่มีความยาวห้าคำ จึงไม่ใช่คำขอที่มีขนาดห้าคำ แต่มันคือทั้งเธรดการสนทนาบวกกับคำห้าคำนั้น
การคำนวณตัวเลขนี้ควรทำสักครั้ง สมมติว่าการโต้ตอบแต่ละครั้งเพิ่มขึ้นประมาณ 500 tokens โดยนับรวมข้อความของคุณและคำตอบของ Claude เข้าด้วยกัน การโต้ตอบครั้งที่ 2 จะส่งข้อมูลประมาณ 1,000 tokens การโต้ตอบครั้งที่ 10 จะส่งประมาณ 5,000 tokens การโต้ตอบครั้งที่ 20 จะส่งประมาณ 10,000 tokens ซึ่งมากกว่าการโต้ตอบครั้งที่ 2 ถึงสิบเท่า ทั้งที่คุณพิมพ์ข้อความในปริมาณเท่าเดิม ตลอดการโต้ตอบยี่สิบครั้ง เธรดนี้จะส่งข้อมูลรวมประมาณ 105,000 tokens ในขณะที่คำถามยี่สิบข้อเดียวกันหากถามในแชทใหม่ยี่สิบครั้งจะใช้ข้อมูลเพียงประมาณ 10,000 tokens ตัวเลขเหล่านี้เป็นการคำนวณเชิงคณิตศาสตร์มากกว่าการวัดผลจริง แต่แสดงให้เห็นภาพรวมที่ถูกต้อง
นี่คือเหตุผลที่งานที่มองเห็นได้เท่ากันอาจมีค่าใช้จ่ายต่างกันมาก คุณพิมพ์คำชุดเดิมไม่ว่าจะใช้วิธีใด ความแตกต่างมาจากปริมาณประวัติการสนทนาที่อยู่เหนือข้อความเหล่านั้น
เธรดที่ยาวมีค่าใช้จ่ายส่วนที่สอง เมื่อการสนทนาเข้าใกล้ขีดจำกัด context window (200,000 tokens สำหรับบัญชี Pro ณ เดือนกันยายน 2026) Claude จะสรุปข้อความก่อนหน้าเพื่อให้แชทดำเนินต่อไปได้ และ Anthropic ระบุว่าการสนทนาที่กระตุ้นให้เกิดการจัดการ context อัตโนมัติดังกล่าวจะใช้โควตาการใช้งานของคุณมากขึ้น การสรุปข้อความถือเป็นงานจริง และคุณต้องจ่ายค่าใช้จ่ายนั้นจากโควตาเดียวกัน
คุณสามารถสังเกตกระบวนการนี้ได้ โดยไปที่ Settings แล้วเลือก Usage ซึ่งบัญชี Pro จะแสดงแถบความคืบหน้าสำหรับช่วงเวลา 5 ชั่วโมงและช่วงเวลารายสัปดาห์ ให้คุณส่งข้อความที่ยี่สิบของเธรดที่ยาว แล้วส่งข้อความแรกของแชทใหม่ จากนั้นเปรียบเทียบว่าแถบความคืบหน้าขยับไปเท่าใด การทำงานของช่วงเวลา 5 ชั่วโมงและช่วงเวลารายสัปดาห์ จะอธิบายว่าแต่ละช่วงเวลาจะรีเซ็ตเมื่อใด
ไฟล์หรือ PDF มีค่าใช้จ่ายเท่าไร
The data behind this chart
[
{
"label": "Text question only",
"input_tokens": 14
},
{
"label": "One tool definition plus a question",
"input_tokens": 403
},
{
"label": "One JPEG photo plus a question",
"input_tokens": 1028
},
{
"label": "One small PDF plus a question",
"input_tokens": 2188
}
]นี่คือตัวอย่างผลลัพธ์ที่แสดงไว้ในเอกสารประกอบการนับโทเค็นของ Anthropic (https://platform.claude.com/docs/en/build-with-claude/token-counting) ซึ่งวัดเทียบกับ claude-opus-5 พรอมต์ทั้งสี่รายการมีความแตกต่างกันเล็กน้อย ดังนั้นให้พิจารณาขนาดของส่วนต่างแทนตัวเลขที่แน่นอน คำถามที่เป็นข้อความสั้นๆ มีการนับโทเค็นขาเข้าอยู่ที่ 14 โทเค็น รูปถ่ายพร้อมคำถามสั้นๆ มีการนับอยู่ที่ 1028 โทเค็น ส่วนไฟล์ PDF (portable document format) ขนาดเล็กหนึ่งไฟล์พร้อมคำถามสั้นๆ มีการนับอยู่ที่ 2188 โทเค็น ซึ่งมากกว่าคำถามแบบข้อความปกติประมาณ 150 เท่า
เมื่อนำข้อมูลนี้ไปรวมกับการส่งข้อมูลซ้ำที่กล่าวถึงข้างต้น ไฟล์แนบจะถูกแปลงเป็นโทเค็นหนึ่งครั้ง จากนั้นจะถูกส่งไปพร้อมกับทุกการโต้ตอบในบทสนทนาถัดจากนั้น หากคุณแนบรายงานขนาด 40 หน้าในข้อความแรก คุณจะต้องจ่ายค่าโทเค็นสำหรับรายงาน 40 หน้านั้นอีกครั้งในข้อความที่สอง ข้อความที่สาม และข้อความที่ยี่สิบ
ตัวเลขค่าใช้จ่ายต่อหน้าที่เผยแพร่นั้นมีจำนวนสูง ในส่วนของ API (application programming interface) ซึ่งมีการระบุตัวเลขไว้อย่างชัดเจน หน้า PDF หนึ่งหน้ามักจะใช้โทเค็นข้อความประมาณ 1,500 ถึง 3,000 โทเค็น ขึ้นอยู่กับความหนาแน่นของเนื้อหา บวกกับค่าใช้จ่ายของรูปภาพหน้ากระดาษ เนื่องจากแต่ละหน้าจะถูกแปลงเป็นรูปภาพด้วย ดังนั้นรายงาน 40 หน้าจึงมีค่าใช้จ่ายมากกว่า 60,000 โทเค็นก่อนที่จะมีการถามคำถามใดๆ เมื่อเทียบกับ context window ขนาด 200,000 โทเค็น นี่ถือเป็นสัดส่วนที่ใหญ่มากของพื้นที่ทั้งหมด ซึ่งถูกใช้ไปกับหน้ากระดาษที่คุณอาจไม่จำเป็นต้องใช้
ดังนั้นแนวทางปฏิบัติจึงเรียบง่าย ให้แนบเฉพาะส่วนที่คุณต้องการ ไม่ใช่ทั้งไฟล์ การขอให้ Claude อ่านรายงานทั้งฉบับเพื่อหาเงื่อนไขการชำระเงิน จะทำให้คุณต้องเสียค่าใช้จ่ายสำหรับรายงานทั้งฉบับในทุกการโต้ตอบที่ตามมา แต่การคัดลอกเฉพาะส่วนเงื่อนไขการชำระเงินมาวาง จะเสียค่าใช้จ่ายเพียงไม่กี่ร้อยโทเค็นในครั้งเดียวเท่านั้น
เหตุผลที่ภาพหน้าจอมีต้นทุนสูงกว่าที่เห็น
The data behind this chart
[
{
"label": "200 x 200 crop",
"standard_tokens": 64,
"high_res_tokens": 64
},
{
"label": "1000 x 1000 screenshot",
"standard_tokens": 1296,
"high_res_tokens": 1296
},
{
"label": "1920 x 1080 screenshot",
"standard_tokens": 1560,
"high_res_tokens": 2691
},
{
"label": "3840 x 2160 screenshot",
"standard_tokens": 1560,
"high_res_tokens": 4784
}
]Claude อ่านภาพโดยแบ่งเป็นตารางของแพตช์ (patches) แต่ละแพตช์คือบล็อกขนาด 28 คูณ 28 พิกเซล ซึ่งนับเป็น visual token หนึ่งหน่วย ดังนั้นต้นทุนของภาพจะคำนวณจากความกว้างหารด้วย 28 (ปัดเศษขึ้น) คูณกับความสูงหารด้วย 28 (ปัดเศษขึ้น) ภาพหน้าจอขนาด 1000 คูณ 1000 พิกเซลจะมีต้นทุนอยู่ที่ 1296 visual tokens ซึ่งมากกว่าจำนวน token ของคำถามส่วนใหญ่ที่ผู้ใช้พิมพ์เสียอีก
การเลือกรุ่นของโมเดลก็ส่งผลต่อเรื่องนี้เช่นกัน Claude 4.7 และรุ่นที่ใหม่กว่าจะอ่านภาพในระดับความละเอียดที่สูงขึ้น ดังนั้นภาพหน้าจอความละเอียด 4K เต็มรูปแบบจะมีต้นทุนอยู่ที่ 4784 visual tokens ในขณะที่รุ่นเก่าซึ่งจะย่อขนาดภาพก่อนประมวลผลจะมีต้นทุนอยู่ที่ 1560 visual tokens จะเห็นได้ว่าไฟล์เดียวกัน หน้าจอเดียวกัน แต่ใช้จำนวน token ต่างกันถึงประมาณสามเท่า
แอป Claude รองรับภาพสูงสุด 20 ภาพต่อหนึ่งข้อความ การส่งภาพหน้าจอเต็มรูปแบบ 20 ภาพถือเป็นคำขอที่มีขนาดใหญ่มากแม้คุณจะยังไม่ได้พิมพ์อะไรลงไปเลยก็ตาม และทุกการโต้ตอบหลังจากนั้นในแชทเดิมจะมีการส่งภาพทั้งหมดนี้ซ้ำอีกครั้ง แนะนำให้ใช้วิธีตัดเฉพาะส่วน (crop) แทน การตัดภาพเฉพาะข้อความแสดงข้อผิดพลาดขนาด 200 คูณ 200 พิกเซลจะมีต้นทุนเพียง 64 visual tokens และมักจะให้คำตอบที่ตรงประเด็นกว่าภาพถ่ายหน้าจอทั้งหมดของคุณ
ระดับการคิดและระดับความพยายามมีค่าใช้จ่ายเท่าใด
ระดับความพยายาม (Effort) เป็นตัวควบคุมปริมาณการคิดของ Claude ก่อนที่จะตอบคำถาม ในแอป Claude การตั้งค่านี้จะอยู่ในเมนูโมเดลถัดจากปุ่มส่ง โดยมีระดับให้เลือกตั้งแต่ low, medium, high, extra high และ max ทาง Anthropic ได้ระบุถึงข้อแลกเปลี่ยนไว้อย่างชัดเจนว่า ระดับความพยายามที่สูงขึ้นจะใช้โทเค็นมากขึ้น ส่งผลให้คุณถึงขีดจำกัดการใช้งานเร็วขึ้น หน้าการตั้งค่าเดียวกันนี้แนะนำให้ใช้ระดับ low หรือ medium สำหรับงานทั่วไป เนื่องจากระดับความพยายามที่ต่ำกว่าจะช่วยให้คุณใช้งานได้ยาวนานขึ้น
กระบวนการคิดยังมีผลต่อเนื่องด้วย ในโมเดลที่เก็บประวัติการสนทนาก่อนหน้าไว้ กระบวนการคิดจากคำตอบที่ผ่านมาจะถูกนับเป็นโทเค็นขาเข้า (input tokens) ในทุกข้อความถัดไปของการสนทนานั้น ดังนั้นการใช้เหตุผลที่ยาวนานจะถูกคิดค่าใช้จ่ายครั้งหนึ่งเมื่อเกิดขึ้น และจะถูกคิดซ้ำบางส่วนในทุกข้อความหลังจากนั้น
การเลือกโมเดลมีผลกระทบอีกประการหนึ่งที่มักทำให้ผู้ใช้ประหลาดใจ นั่นคือตัวตัดคำ (tokenizer) ซึ่งเป็นส่วนที่แบ่งข้อความเป็นโทเค็น ได้มีการเปลี่ยนแปลงใน Claude 4.7 ข้อความนำเข้าชุดเดียวกันจะสร้างโทเค็นมากกว่าเดิมประมาณ 30 เปอร์เซ็นต์บน Claude 4.7 และโมเดลรุ่นใหม่กว่าเมื่อเทียบกับรุ่นก่อนหน้า Anthropic ไม่ได้เปิดเผยว่าจำนวนโทเค็นเหล่านี้ถูกแปลงเป็นสัดส่วนการใช้งานของแพ็กเกจ Pro อย่างไร ดังนั้นให้ถือว่านี่เป็นเหตุผลที่ควรเลือกใช้การตั้งค่าที่เบาลงสำหรับงานทั่วไป แทนที่จะมองว่าเป็นอัตราแลกเปลี่ยนคงที่ สำหรับการใช้งานแบบจ่ายตามจริง (pay as you go) ข้อมูลการคำนวณจะถูกเปิดเผยต่อสาธารณะ และ โทเค็นขาเข้าและขาออกมีราคาที่แตกต่างกันในส่วนนั้น
เหตุใด Agent และ Claude Code จึงใช้โควตาจำกัดเร็วที่สุด
Claude Code และแอป Claude ใช้โควตาการใช้งานร่วมกัน
ทั้งแผน Pro และ Max มีโควตาการใช้งานที่ใช้ร่วมกันระหว่าง Claude และ Claude Code ซึ่งหมายความว่ากิจกรรมทั้งหมดในเครื่องมือทั้งสองจะถูกนำไปนับรวมในโควตาการใช้งานเดียวกัน
การทำงานของ Agent จะอ่านข้อมูลมากกว่าการเขียนข้อมูลอย่างมาก คำขอเดียวเพื่อแก้ไขบั๊กอาจเปิดไฟล์สิบไฟล์ เรียกใช้การค้นหา อ่านผลลัพธ์ และตอบกลับด้วยคำอธิบายเพียงสี่บรรทัด คุณจะเห็นเพียงสี่บรรทัด แต่โควตาการใช้งานจะนับทุกไฟล์ที่ถูกอ่านในระหว่างกระบวนการนั้น นี่คือช่องว่างที่กว้างที่สุดระหว่างสิ่งที่เห็นในเซสชันกับต้นทุนที่เกิดขึ้นจริง
เครื่องมือต่างๆ ยังใช้โทเค็นก่อนที่คุณจะถามคำถามใดๆ เนื่องจากคำอธิบายของแต่ละเครื่องมือจะถูกส่งไปพร้อมกับคำขอ ในตัวอย่างที่เผยแพร่ข้างต้น คำถามสั้นๆ ที่ไม่มีการใช้เครื่องมือจะนับเป็น 14 input tokens ในขณะที่คำถามสั้นๆ ที่มีการกำหนดเครื่องมือหนึ่งรายการจะนับเป็น 403 การตั้งค่า Agent ในการใช้งานจริงมักจะมีเครื่องมือมากกว่าหนึ่งรายการ
ภายใน Claude Code คำสั่ง /status จะแสดงโควตาที่เหลืออยู่ในเซสชันของคุณ การรักษาบริบทการทำงานให้มีขนาดเล็กเป็นวิธีที่มีประสิทธิภาพที่สุดที่คุณสามารถทำได้ และ การจัดการบริบทในเซสชัน Claude Code ที่ยาวนาน จะครอบคลุมวิธีการดำเนินการดังกล่าว ค่าใช้จ่ายแฝงที่ Agent ต้องแบกรับก่อนคำสั่งแรกของคุณ จะอธิบายถึงส่วนต่างที่เหลือทั้งหมด
เหตุใดงานเดียวกันจึงมีค่าใช้จ่ายสูงกว่าในบางภาษา
Tokenizer ถูกปรับแต่งมาเพื่อข้อความภาษาอังกฤษเป็นหลัก ดังนั้นคำภาษาอังกฤษที่พบบ่อยมักจะถูกนับเป็น 1 โทเค็นต่อคำ ความหมายเดียวกันเมื่อเขียนเป็นภาษารัสเซีย อาหรับ ฮินดี หรือญี่ปุ่น มักจะถูกแบ่งออกเป็นหลายโทเค็น ซึ่งหมายความว่าคำถามที่เหมือนกันจะใช้โควตาของคุณมากกว่า กลไกในหน้านี้เหมือนกันทุกประการ แต่ราคาต่อประโยคไม่เท่ากัน
ให้วัดผลด้วยกรณีของคุณเองแทนการเชื่อการประมาณการ Endpoint สำหรับนับโทเค็นของ Anthropic สามารถเรียกใช้งานได้ฟรีและจะส่งกลับจำนวนโทเค็นขาเข้าสำหรับข้อความใดๆ:
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "content-type: application/json" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5",
"messages": [{"role": "user", "content": "Paste your paragraph here"}]
}'การตอบกลับจะเป็นบรรทัดเดียว:
{"input_tokens": 14}ให้ลองรันสองครั้ง ครั้งแรกด้วยย่อหน้าภาษาอังกฤษ และครั้งที่สองด้วยย่อหน้าเดียวกันในภาษาของคุณ จากนั้นเปรียบเทียบตัวเลขทั้งสอง การเรียกใช้งานนี้ไม่มีค่าใช้จ่าย แต่จำเป็นต้องมี API key จาก Claude Console ที่ platform.claude.com ซึ่งเป็นบัญชีแยกต่างหากจากการสมัครสมาชิก Pro ของคุณ การเปลี่ยนไปใช้ภาษาอังกฤษมักจะไม่คุ้มค่า เพราะคุณสามารถคิดและเขียนได้เร็วกว่าในภาษาของคุณเอง ให้รักษาความยาวของเธรดให้สั้นและไฟล์แนบให้มีขนาดเล็กแทน สองนิสัยนี้จะช่วยให้คุณประหยัดได้มากกว่าผู้ที่ใช้ภาษาอังกฤษเป็นภาษาหลัก
นิสัยที่ช่วยให้แผน Pro ใช้งานได้ยาวนานขึ้น
- เริ่มบทสนทนาใหม่เมื่อเปลี่ยนหัวข้อ นี่คือนิสัยที่สำคัญที่สุดในรายการนี้ เนื่องจากความยาวของเธรดจะเพิ่มต้นทุนของทุกข้อความที่ตามมา
- แนบเฉพาะส่วนที่เกี่ยวข้อง ไม่ใช่แนบไฟล์ทั้งหมด ส่งเพียง 3 หน้าแทนที่จะเป็น 40 หน้า
- ครอปภาพหน้าจอให้เหลือเฉพาะส่วนที่เป็นข้อความแจ้งเตือนข้อผิดพลาด
- ใส่บริบทที่ต้องใช้บ่อยไว้ใน Project แทนการคัดลอกวางในทุกแชทใหม่ Anthropic ระบุว่าเนื้อหาใน Project จะถูกแคชไว้และไม่นำมานับรวมในขีดจำกัดการใช้งานเมื่อมีการนำกลับมาใช้ใหม่ ดังนั้นคู่มือสไตล์หรือ Schema ควรเก็บไว้ในส่วนความรู้ของ Project
- ลดระดับความพยายามในการถามลงมาเป็นระดับต่ำหรือปานกลางสำหรับคำถามทั่วไป และเก็บความพยายามระดับสูงไว้สำหรับงานที่คุ้มค่ากับทรัพยากรนั้น
- ถามคำถามทั้งหมดในข้อความเดียว การถามเพื่อขอคำอธิบายเพิ่มเติม 3 รอบมีต้นทุนสูงกว่าการส่งข้อความที่มีรายละเอียดครบถ้วนเพียงครั้งเดียว เพราะทุกรอบของการสนทนาจะมีการส่งข้อมูลทั้งหมดที่อยู่ด้านบนซ้ำอีกครั้ง
เมื่อโควตาการใช้งานหมดลง
ราคาของ Pro อยู่ที่ 20 ดอลลาร์ต่อเดือนสำหรับการเรียกเก็บเงินรายเดือน หรือ 17 ดอลลาร์ต่อเดือนสำหรับการเรียกเก็บเงินรายปี ณ เดือนกันยายน 2026 โดย Anthropic ระบุว่าผู้ใช้จะได้รับโควตาการใช้งานมากกว่าแผนฟรีอย่างน้อย 5 เท่าต่อรอบการใช้งาน 5 ชั่วโมง รายละเอียดราคาและขีดจำกัดของแผน Pro ได้อธิบายเกี่ยวกับตัวแผนไว้แล้ว แนวทางปฏิบัติข้างต้นช่วยให้คุณใช้งานได้จริงมากขึ้น แต่ก็ยังมีขีดจำกัดอยู่ หากคุณใช้งานโควตาหมดเพียงเดือนละครั้ง ปัญหานี้ก็ถือว่าจัดการได้ แต่หากคุณใช้งานโควตาหมดทุกสองสามวันในงานที่คุณได้รับค่าตอบแทน การพิจารณาว่า การตัดสินใจเลือกใช้ Max คือคำตอบที่เหมาะสมหรือไม่ จะเป็นการใช้เวลาของคุณที่คุ้มค่ากว่า
FAQ
ทำไมโควตา Claude Pro ของฉันถึงหมดเร็วมากในวันนี้?
สาเหตุส่วนใหญ่มาจากการสนทนาที่ยาวนาน การแนบไฟล์ หรือทั้งสองอย่างรวมกัน ทุกข้อความที่ส่งจะส่งประวัติการสนทนาทั้งหมดไปด้วย ดังนั้นข้อความที่ยี่สิบจึงมีต้นทุนสูงกว่าข้อความที่สองหลายเท่า แม้ว่าคุณจะพิมพ์จำนวนคำเท่าเดิมก็ตาม ไฟล์ที่แนบจะถูกส่งซ้ำไปพร้อมกับข้อความทุกครั้ง ให้เปิด Settings แล้วไปที่ Usage เพื่อดูว่าคุณใช้โควตาในช่วง 5 ชั่วโมงและช่วงสัปดาห์ไปเท่าไรแล้ว จากนั้นให้เริ่มแชทใหม่สำหรับคำถามที่ไม่เกี่ยวข้องกัน
การเริ่มบทสนทนาใหม่ช่วยประหยัดโควตาหรือไม่?
ช่วยได้ และเป็นนิสัยที่ประหยัดที่สุดที่ทำได้ การแชทใหม่จะเริ่มโดยไม่มีประวัติ ดังนั้นข้อความแรกจะมีต้นทุนเท่ากับสิ่งที่คุณพิมพ์เท่านั้น ข้อแลกเปลี่ยนคือ Claude จะไม่ทราบสิ่งที่พูดคุยกันก่อนหน้านี้อีกต่อไป ดังนั้นให้คัดลอกสรุปสั้นๆ ของส่วนที่เป็นประโยชน์แทนการคัดลอกประวัติการสนทนาทั้งหมด การคัดลอกบทสนทนาเก่าทั้งหมดลงในแชทใหม่จะทำให้เกิดปัญหาเดิมที่คุณพยายามหลีกเลี่ยง
ไฟล์ที่แนบมายังคงใช้โควตาหลังจากข้อความแรกหรือไม่?
ใช่ หากอยู่ในบทสนทนาเดิม ไฟล์จะถูกแปลงเป็น token หนึ่งครั้ง และ token เหล่านั้นจะกลายเป็นส่วนหนึ่งของประวัติการสนทนาที่ทุกข้อความถัดไปต้องแบกรับ ไฟล์ PDF ขนาด 40 หน้าจะยังคงอยู่ในคำขอจนกว่าแชทจะสิ้นสุด ไฟล์ที่วางไว้ใน Projects เป็นข้อยกเว้น เนื่องจาก Anthropic ระบุว่าเนื้อหาใน Project จะถูกแคชไว้และไม่นับรวมในโควตาเมื่อมีการนำกลับมาใช้ใหม่
การเขียนด้วยภาษาอื่นที่ไม่ใช่ภาษาอังกฤษใช้โควตามากกว่าหรือไม่?
โดยปกติแล้วใช่ ตัวตัดคำ (tokenizer) จะแบ่งข้อความที่ไม่ใช่ภาษาอังกฤษออกเป็นจำนวน token ที่มากกว่าเพื่อให้ได้ความหมายเดียวกัน ดังนั้นคำถามเดียวกันจะมีต้นทุนสูงกว่าหากใช้ภาษารัสเซียหรือภาษาญี่ปุ่นเมื่อเทียบกับภาษาอังกฤษ คุณสามารถวัดความแตกต่างได้ด้วยตนเองโดยการนับจำนวน token ของย่อหน้าเดียวกันในทั้งสองภาษาผ่าน endpoint สำหรับนับ token ฟรี ควรทำให้เธรดสั้นและไฟล์แนบมีขนาดเล็กแทนการเปลี่ยนภาษา นิสัยเหล่านี้ช่วยประหยัดโควตาได้มากกว่าสำหรับคุณเมื่อเทียบกับผู้ใช้ภาษาอังกฤษ
Claude Code ใช้โควตาร่วมกับแอป Claude หรือไม่?
ใช่ Anthropic ระบุว่าโควตาการใช้งานของ Pro และ Max จะใช้ร่วมกันระหว่าง Claude และ Claude Code ดังนั้นกิจกรรมในทั้งสองช่องทางจะถูกนับรวมในโควตาเดียวกัน เซสชันของ Agent จะใช้โควตาอย่างรวดเร็ว เนื่องจากคำขอเดียวอาจอ่านไฟล์จำนวนมากและเรียกใช้เครื่องมือหลายอย่างก่อนที่จะตอบกลับ ให้รันคำสั่ง /status ภายใน Claude Code เพื่อดูว่าเหลือโควตาเท่าไรในเซสชันปัจจุบัน