SSD Nodes Learn Hosting plans →
คู่มือ Matt Connorโดย Matt Connor · อัปเดตเมื่อ 2026-09-06

ราคา Claude Fable 5 และวิธีคำนวณค่าใช้จ่ายในการใช้งาน

สรุปราคา Claude Fable 5 ที่ 10 ดอลลาร์ต่อล้าน input token และ 50 ดอลลาร์ต่อล้าน output token พร้อมเปรียบเทียบความคุ้มค่ากับรุ่น Sonnet และ Opus เพื่อการเลือกใช้งานที่เหมาะสม

Claude Fable 5 มีค่าใช้จ่ายเท่าใด

Claude Fable 5 มีค่าใช้จ่าย $10 ต่อล้าน input token และ $50 ต่อล้าน output token บน Claude API นี่คือราคาตามรายการที่ Anthropic ประกาศไว้ ซึ่งอ่านจากหน้าแสดงราคาเมื่อวันที่ 3 สิงหาคม 2026 โดยมี model ID ของ API คือ claude-fable-5 โมเดลนี้เปิดให้ใช้งานทั่วไปเมื่อวันที่ 9 มิถุนายน 2026 บน Claude API, Amazon Bedrock, Claude Platform บน AWS, Google Cloud และ Microsoft Foundry

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

ให้มองราคาเป็นขั้นบันได Fable 5 มีราคาเป็น 2 เท่าของ Claude Opus 5, เป็น 5 เท่าของราคา Claude Sonnet 5 ในปัจจุบัน และเป็น 10 เท่าของ Claude Haiku 4.5 อัตราส่วนนี้เท่ากันทั้งฝั่ง input และ output เนื่องจากโมเดลทุกตัวในตารางนี้กำหนดราคา output ไว้ที่ 5 เท่าของราคา input ของตัวเองพอดี ดังนั้นหากคุณทราบสัดส่วนของ input และ output token สำหรับงานหนึ่งๆ คุณสามารถคำนวณราคาเปรียบเทียบกับโมเดลอื่นได้โดยการคูณ

มีวันที่หนึ่งที่ส่งผลต่อการคำนวณ คือ Sonnet 5 อยู่ในช่วงราคาแนะนำที่ $2 และ $10 ต่อล้าน token จนถึงวันที่ 31 สิงหาคม 2026 ตั้งแต่วันที่ 1 กันยายน 2026 เป็นต้นไป ราคาจะปรับเป็น $3 และ $15 ในขณะที่ราคาของ Fable 5 ไม่มีการเปลี่ยนแปลง ดังนั้นช่องว่างราคาของทั้งสองโมเดลจะแคบลงจาก 5 เท่าเหลือเพียงประมาณ 3 เท่ากว่าๆ ในวันดังกล่าว หากคุณกำลังจัดทำงบประมาณสำหรับช่วงฤดูใบไม้ร่วง ให้ใช้ตัวเลขราคาของ Sonnet ที่จะปรับเปลี่ยนในภายหลังนี้

ส่วนลดและตัวคูณที่ส่งผลในทิศทางตรงกันข้าม

Prompt caching เป็นกลไกที่ช่วยประหยัดค่าใช้จ่ายได้มากที่สุด การอ่านข้อมูลจากแคชมีราคาเพียงหนึ่งในสิบของราคา input พื้นฐาน ซึ่งอยู่ที่ $1 ต่อล้านโทเค็นบน Fable 5 การเขียนข้อมูลลงแคชจะมีราคาสูงกว่า input token ปกติ โดยอยู่ที่ 1.25 เท่าของราคาพื้นฐานสำหรับแคชระยะเวลา 5 นาที และ 2 เท่าของราคาพื้นฐานสำหรับแคชระยะเวลา 1 ชั่วโมง แคชระยะเวลา 5 นาทีจะคุ้มทุนหลังจากการอ่านเพียงครั้งเดียว ส่วนแคชระยะเวลา 1 ชั่วโมงจะคุ้มทุนหลังจากการอ่านสองครั้ง การคำนวณนี้คือเหตุผลสำคัญในการ คำนวณจุดคุ้มทุนของ prompt caching ก่อนที่คุณจะเปิดใช้งานในทุกส่วน

Batch API มอบส่วนลด 50% ทั้งในส่วนของ input และ output ทำให้งานที่ประมวลผลแบบ batch บน Fable 5 มีราคาอยู่ที่ $5 และ $25 ต่อล้านโทเค็น คำขอแบบ batch ทำงานในรูปแบบ asynchronous ดังนั้นวิธีนี้จึงเหมาะสำหรับงานที่ไม่จำเป็นต้องได้รับคำตอบในทันที ส่วนลดทั้งสองประเภทสามารถใช้ร่วมกันได้ ซึ่งทำให้งานที่ใช้ทั้งการแคชและ batch มีราคาถูกลงทั้งสองด้าน

Context window ขนาด 1M โทเค็นรวมอยู่ในอัตราค่าบริการมาตรฐานสำหรับ Claude 4.6 และรุ่นที่ใหม่กว่า โดยไม่มีการคิดค่าธรรมเนียมเพิ่มเติมสำหรับ context ขนาดใหญ่ ดังนั้นคำขอขนาด 900k โทเค็นจะถูกเรียกเก็บเงินในอัตราต่อโทเค็นเท่ากับคำขอขนาด 9k โทเค็น

ตัวคูณที่ทำให้ค่าใช้จ่ายเพิ่มขึ้นคือ data residency การตั้งค่า inference_geo: "us" เพื่อให้การประมวลผล (inference) อยู่ภายในสหรัฐอเมริกาจะส่งผลให้มีการคูณราคาเพิ่มขึ้น 1.1 เท่าในทุกหมวดหมู่โทเค็น รวมถึงการอ่านและเขียนแคชด้วย ควรคงการตั้งค่า global routing ตามค่าเริ่มต้นไว้ เว้นแต่จะมีข้อกำหนดในสัญญาที่ระบุเป็นอย่างอื่น

กฎการเรียกเก็บเงินข้อหนึ่งมีผลเฉพาะกับโมเดลนี้เท่านั้น Fable 5 มาพร้อมกับ safety classifiers ที่สามารถปฏิเสธคำขอได้ เมื่อเกิดเหตุการณ์ดังกล่าว Messages API จะส่งคืนค่า stop_reason: "refusal" ในรูปแบบการตอบกลับ HTTP 200 ที่สำเร็จแทนที่จะเป็นข้อผิดพลาด และคุณจะไม่ถูกเรียกเก็บเงินสำหรับคำขอที่ถูกปฏิเสธก่อนที่จะมีการสร้าง output ใดๆ หากคุณส่ง prompt เดิมซ้ำไปยัง Claude รุ่นอื่น ระบบจะคืนเครดิตค่า prompt cache ที่ใช้ในการสลับโมเดลให้ เพื่อให้คุณไม่ต้องเสียค่าใช้จ่ายในการอุ่นแคช (warm cache) ซ้ำในข้อมูลชุดเดิม

แผนใดบ้างที่รวม Claude Fable 5 ไว้ด้วย

ณ วันที่ 3 สิงหาคม 2026 หน้าเว็บ Claude Fable ของ Anthropic ระบุว่าโมเดลนี้พร้อมใช้งานสำหรับผู้ใช้ระดับ Pro, Max, Team และ Enterprise ส่วนแผนฟรีไม่ได้ถูกระบุไว้ แผน Pro เป็นระดับที่ราคาถูกที่สุดในรายการดังกล่าว ดังนั้น ราคาของ Pro และขีดจำกัดการใช้งาน จึงเป็นเกณฑ์ขั้นต่ำสำหรับทุกช่องทางการสมัครสมาชิกเพื่อเข้าถึง Fable หากการเข้าถึง Fable เป็นเหตุผลหลักที่คุณจะอัปเกรด ให้พิจารณา ว่าแผน Pro คุ้มค่ากับการใช้งานของคุณหรือไม่ ก่อน เนื่องจากโควตาการใช้งาน Fable ที่จำกัดอาจไม่คุ้มค่ากับการสมัครสมาชิกเพียงอย่างเดียว สำหรับนักพัฒนา โมเดลนี้พร้อมใช้งานทั่วไปผ่าน Claude API และผ่าน cloud marketplace ที่ระบุไว้ข้างต้น โดยไม่มีระดับการใช้งานฟรีในช่องทางนี้ ดังนั้น เครดิตจำนวนเล็กน้อยที่ Anthropic มอบให้เมื่อสมัครใช้งาน จึงเป็นสิ่งเดียวที่คุณได้รับก่อนที่จะเริ่มมีการคิดค่าใช้จ่าย

การมีให้ใช้งานในแพ็กเกจไม่ได้หมายความว่ารวมการใช้งานแบบไม่จำกัด และ subscription ก็ไม่ได้คิดตามปริมาณแบบเดียวกับ API เพราะ Pro seat ไม่มี token quota ที่ประกาศไว้เลย แต่จะนับการใช้งานเป็นจำนวนข้อความภายใน rolling window แทน ดังนั้นจึงไม่สามารถแปลงสิ่งที่รวมอยู่ในแพ็กเกจให้เป็นตัวเลขต่อหนึ่งล้านหน่วยด้านบนได้โดยตรง

ตารางเปรียบเทียบแพ็กเกจบนหน้าราคาแบบชำระเงินของ Anthropic กำหนดให้ Fable ใช้โควตาการใช้งานรายสัปดาห์ได้บางส่วนสำหรับ seat บางประเภท และใช้ usage credits สำหรับ seat ประเภทอื่น การจัดสรรนี้มีการเปลี่ยนแปลงมากกว่า 1 ครั้งในช่วง July 2026

คำชี้แจงของ Anthropic เองเกี่ยวกับการเปิดให้ใช้งาน Fable 5 อีกครั้งระบุว่า โมเดลนี้รวมอยู่ในสัดส่วนสูงสุด 50% ของโควตาการใช้งานรายสัปดาห์จนถึง 7 July 2026 สำหรับแพ็กเกจ Pro, Max, Team และ Enterprise บางรายการ หลังจากวันที่ดังกล่าวจะใช้ usage credits แทน รายงานในช่วงที่เหลือของ July ระบุว่ามีการขยายระยะเวลาเพิ่มเติม และมีการแยกเงื่อนไขตามประเภทของ seat

ดังนั้น หน้านี้จะไม่ระบุขีดจำกัดต่อแผน เนื่องจากไม่มีตัวเลขใดที่ประกาศในช่วงเดือนนั้นคงอยู่ได้นานถึงสองสัปดาห์ และตัวเลขที่ล้าสมัยในที่นี้จะส่งผลเสียมากกว่าการไม่ระบุเลย ให้เปิดแถวที่ระบุว่า Fable ในตารางเปรียบเทียบแผนในวันที่คุณตัดสินใจ และให้ถือว่าตัวเลขใดก็ตามในบทความข่าวเป็นข้อมูลที่ล้าสมัย หากคุณสมัครสมาชิกเพื่อเข้าถึง Fable แล้วพบว่าโควตาการใช้งานน้อยกว่าที่ตารางระบุไว้ การยกเลิกแผนก่อนการต่ออายุครั้งถัดไป จะช่วยให้คุณยังคงใช้งานได้จนครบเดือนที่คุณจ่ายเงินไปแล้ว

สิ่งที่คงที่คืออัตราค่าบริการ API ในทุกช่องทาง เมื่อใช้โควตาที่รวมอยู่ในแผนจนหมด การใช้งาน Fable 5 เพิ่มเติมจะถูกคิดค่าใช้จ่ายตามราคาในตารางด้านบน แผน Enterprise ได้ระบุโครงสร้างนี้ไว้อย่างชัดเจน เนื่องจาก ค่าธรรมเนียมสมาชิก Enterprise เป็นเพียงค่าสิทธิ์ในการเข้าถึง ในขณะที่โทเค็นยังคงถูกคิดค่าใช้จ่ายตามอัตรา API เพิ่มเติมจากค่าธรรมเนียมดังกล่าว นั่นทำให้รายการราคาเป็นตัวเลขที่คุณต้องใช้ในการวางแผน ซึ่งเป็นข้อสรุปเดียวกับที่คุณจะได้รับเมื่อ เปรียบเทียบการเรียกเก็บเงินผ่าน API กับการสมัครสมาชิก สำหรับโมเดล Claude อื่น ๆ หากคุณยังไม่ได้เลือกแผน ให้เริ่มจาก แผน Claude ที่เหมาะสมกับการใช้งานของคุณ หากแผนนั้นจะเป็นผู้ช่วยส่วนตัวในชีวิตประจำวันของคุณด้วย ไม่ใช่เพียงแค่ช่องทางเข้าถึง Fable เท่านั้น ควรตรวจสอบ การเปรียบเทียบราคาแผน Claude กับ ChatGPT ก่อนที่คุณจะตัดสินใจเลือกแผนใดแผนหนึ่ง

เหตุผลที่ค่าใช้จ่ายของคุณสูงกว่าอัตราส่วนราคาที่คาดการณ์ไว้

มีกลไกที่ได้รับการบันทึกไว้สองประการที่ทำให้ Fable 5 มีค่าใช้จ่ายสูงกว่าการเปรียบเทียบราคาโดยตรง

ประการแรกคือตัวตัดคำ (tokenizer) โดย Fable 5 ใช้ตัวตัดคำที่เปิดตัวพร้อมกับ Claude Opus 4.7 เมื่อเทียบกับโมเดลที่ออกก่อนหน้า Opus 4.7 ข้อความเดียวกันจะสร้างโทเค็นเพิ่มขึ้นประมาณ 30% โดยการเพิ่มขึ้นที่แท้จริงจะขึ้นอยู่กับเนื้อหา เนื่องจาก Haiku 4.5 ใช้ตัวตัดคำรุ่นก่อนหน้า ช่องว่างราคาที่ระบุไว้ว่าต่างกันสิบเท่าจึงกลายเป็นประมาณสิบสามเท่าเมื่อคุณป้อนข้อความชุดเดียวกันให้กับทั้งสองโมเดล ส่วน Sonnet 5 ใช้ตัวตัดคำรุ่นใหม่กว่า ดังนั้นการเปรียบเทียบ Fable กับ Sonnet จึงเป็นการเปรียบเทียบต่อโทเค็นที่ยุติธรรม แต่การเปรียบเทียบ Fable กับ Haiku นั้นไม่ใช่

ประการที่สองคือการคิด (thinking) ระบบการคิดแบบปรับเปลี่ยนได้ (adaptive thinking) จะเปิดใช้งานอยู่เสมอสำหรับ Fable 5 และไม่รองรับ thinking: {"type": "disabled"} โทเค็นที่ใช้ในการคิดจะถูกเรียกเก็บเงินในอัตราเดียวกับโทเค็นขาออก (output tokens) ในราคาเต็ม กระบวนการคิดแบบดิบ (raw chain of thought) จะไม่ถูกส่งกลับมาในโมเดลนี้ และ thinking.display จะถูกตั้งค่าเริ่มต้นไว้ที่ "omitted" ซึ่งหมายความว่าคำตอบที่มองเห็นได้สั้นๆ อาจมีจำนวนโทเค็นขาออกที่ถูกเรียกเก็บเงินจำนวนมาก เอกสารของ Anthropic ระบุไว้อย่างชัดเจนว่าจำนวนโทเค็นขาออกที่เรียกเก็บเงินจะไม่ตรงกับจำนวนโทเค็นที่มองเห็นได้ในคำตอบ

โปรดอ่านรายละเอียดแทนการคาดเดา โดยฟิลด์ usage.output_tokens_details.thinking_tokens จะรายงานว่ามีโทเค็นขาออกที่ถูกเรียกเก็บเงินจำนวนเท่าใดที่ใช้ไปกับการให้เหตุผล:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

ในตัวอย่างนั้น ซึ่งนำมาจากเอกสารประกอบเรื่องการคิดของ Anthropic โทเค็นขาออกที่ถูกเรียกเก็บเงินจำนวน 312 จาก 348 โทเค็น คือการให้เหตุผลที่ไม่มีใครมองเห็น เมื่อคุณทำการสตรีมข้อมูล รายละเอียดนี้จะมาถึงเฉพาะในเหตุการณ์ message_delta สุดท้ายเท่านั้น ดังนั้นไคลเอนต์ที่หยุดอ่านข้อมูลที่ส่วนข้อความสุดท้ายจะไม่บันทึกค่านี้ไว้

การควบคุมทำได้ผ่าน effort ซึ่งตั้งค่าไว้ที่ output_config.effort โดยมีระดับต่างๆ คือ low, medium, high (ค่าเริ่มต้น), xhigh และ max

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

คำแนะนำของ Anthropic สำหรับโมเดลนี้คือให้เริ่มที่ high และปรับขึ้นไปที่ xhigh เฉพาะสำหรับงานที่ต้องการความสามารถสูงมากเท่านั้น และให้ปรับลดลงมาที่ medium หรือ low สำหรับงานทั่วไป เนื่องจากความพยายามที่น้อยกว่าใน Fable 5 มักจะให้ผลลัพธ์ที่ดีกว่า xhigh ในโมเดลรุ่นก่อนหน้า อย่างไรก็ตามมีข้อควรระวังสองประการคือ การเปลี่ยนระดับความพยายามระหว่างคำขอจะทำให้ prompt cache ของคุณใช้งานไม่ได้ เนื่องจากค่าความพยายามที่กำหนดจะถูกรวมเข้าไปใน prompt ดังนั้นควรเลือกระดับความพยายามต่อภาระงานและคงค่าไว้ให้คงที่ และ max_tokens เป็นการจำกัดจำนวนขาออกรวม (ทั้งการคิดและข้อความตอบกลับ) ดังนั้นหากคุณตั้งค่าขีดจำกัดไว้สำหรับคำตอบที่ไม่มีการคิด ระบบจะตัดข้อความทิ้ง หากพบ stop_reason: "max_tokens" หมายความว่าคุณต้องเพิ่มขีดจำกัดหรือลดระดับความพยายามลง

ต้นทุนต่อหนึ่งงานที่เสร็จสมบูรณ์ ไม่ใช่ต้นทุนต่อโทเค็น

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

แถว 3 แถวนั้นเป็นการคำนวณทางคณิตศาสตร์ ไม่ใช่เกณฑ์มาตรฐาน อัตราค่าบริการมีการประกาศไว้อย่างชัดเจน ส่วนปริมาณโทเค็นเป็นเพียงสมมติฐานที่คุณควรแทนที่ด้วยตัวเลขจากข้อมูลการใช้งานจริงของคุณ เซสชันการเขียนโค้ดที่มีลักษณะเหมือนแถวกลางจะมีต้นทุน $5.00 บน Fable 5 เทียบกับ $1.00 บน Sonnet 5 ส่วนงานระยะยาวจะมีต้นทุน $40.00 เทียบกับ $8.00 คอลัมน์ Haiku ในแถวสุดท้ายนั้นเป็นการคำนวณทางคณิตศาสตร์เท่านั้น เนื่องจาก Haiku 4.5 มี context window เพียง 200k โทเค็น จึงไม่สามารถรองรับงานดังกล่าวได้เลย

ต้นทุนต่อโทเค็นไม่ใช่หน่วยวัดที่เหมาะสมสำหรับการตัดสินใจ ต้นทุนต่อหนึ่งงานที่เสร็จสมบูรณ์คือต้นทุนต่อการพยายามหนึ่งครั้งคูณด้วยจำนวนครั้งที่พยายาม ณ อัตราปัจจุบัน การพยายามด้วย Fable 5 หนึ่งครั้งมีต้นทุนเท่ากับการพยายามด้วย Sonnet 5 ถึงห้าครั้ง ดังนั้นแค่จำนวนครั้งที่ต้องทำซ้ำแทบจะไม่เพียงพอที่จะเป็นเหตุผลในการอัปเกรด Sonnet จะต้องล้มเหลวมากกว่าสี่ในห้าครั้งเสียก่อน แนวทางที่ถูกกว่าจึงจะเริ่มเสียเปรียบในแง่ของโทเค็น

สิ่งที่ใช้เป็นเหตุผลในการตัดสินใจได้จริงคือทุกสิ่งที่บิลค่าโทเค็นไม่ได้แสดงให้เห็น ช่องว่างระหว่างงานระยะยาวทั้งสองในตารางนั้นน้อยกว่าค่าแรงวิศวกรหนึ่งชั่วโมงในตลาดส่วนใหญ่ หากโมเดลที่มีราคาสูงกว่าช่วยประหยัดเวลาในการตรวจสอบได้หนึ่งชั่วโมง หรือช่วยหลีกเลี่ยงการย้ายระบบที่ผิดพลาดซึ่งคุณต้องมาแก้ไขภายหลัง โมเดลนั้นก็ถือว่าคุ้มทุนในตัวเองแล้วบนบิลค่าใช้จ่ายที่ไม่เคยแสดงตัวเลขส่วนที่ประหยัดได้นี้ ให้เปรียบเทียบโดยใช้เงินต่อผลลัพธ์ที่ยอมรับได้ และรวมเวลาของคุณเองเข้าไปในยอดรวมด้วย การ ทำความเข้าใจว่าหนึ่งล้านโทเค็นซื้ออะไรได้บ้าง จะช่วยให้การประเมินนั้นเป็นรูปธรรมมากขึ้น

สามงานที่ Claude Fable 5 คุ้มค่ากับราคาที่จ่าย

การรันเอเจนต์ระยะยาวที่ความผิดพลาดมีต้นทุนสูง Fable 5 ถูกสร้างมาเพื่องานที่วัดผลเป็นชั่วโมง ด้วย context window ขนาด 1M token และ output token สูงสุด 128k ต่อคำขอ พร้อมระดับความพยายาม xhigh ที่มุ่งเน้นงานซึ่งใช้เวลาประมวลผลนานกว่า 30 นาทีและมีงบประมาณ token หลักล้าน ให้เปรียบเทียบต้นทุนการรันงานกับค่าใช้จ่ายในการแก้ไขงานหลังจากเอเจนต์เดินผิดทางในขั้นตอนที่ 40 ซึ่งไม่มีใครสังเกตเห็นจนกระทั่งถึงขั้นตอนที่ 300

การย้ายระบบหรือการตรวจสอบ codebase ขนาดใหญ่ที่ทำเพียงครั้งเดียว งานประเภททำครั้งเดียวไม่มีปริมาณงานมากพอที่จะเฉลี่ยต้นทุน ดังนั้นส่วนต่างราคาต่อ token จะปรากฏในใบแจ้งหนี้เพียงครั้งเดียว และงานทั้งหมดอาจพอดีกับ context window เพียงหน้าต่างเดียว หากงานสามารถรันแบบอะซิงโครนัสได้ การใช้ Batch API จะช่วยลดราคาลงครึ่งหนึ่งเหลือ $25 ต่อล้าน output tokens

งานที่โมเดลราคาถูกกว่าล้มเหลวมาแล้วสองครั้ง การพยายามสองครั้งที่ล้มเหลวบวกกับเวลาที่คุณใช้ดีบั๊กมีต้นทุนสูงกว่าการใช้ Fable เพียงครั้งเดียวตามปริมาณงานในตารางด้านบน การยกระดับไปใช้โมเดลที่สูงขึ้นเป็นทางเลือกที่ประหยัดกว่า และนั่นคือจุดประสงค์ของโมเดลแบบขั้นบันได หากคุณยังคงตัดสินใจเลือกระหว่างระดับต่างๆ การเปรียบเทียบความสามารถระหว่าง Claude model tiers จะช่วยตอบคำถามที่แตกต่างจากหน้านี้

สามงานที่ Sonnet 5 หรือ Haiku 4.5 คือคำตอบที่เหมาะสมที่สุด

งานจำแนกประเภทและดึงข้อมูลปริมาณมาก งานเหล่านี้วัดผลที่ปริมาณงาน (throughput) และต้นทุนต่อหน่วย โดยเพดานคุณภาพที่ต้องการนั้นต่ำพอที่โมเดลราคาประหยัดจะทำได้ หากงานที่ Haiku 4.5 ทำได้อย่างถูกต้องมีราคาถูกกว่าถึงสิบเท่า การใช้ Fable 5 ก็ไม่ได้ให้ผลลัพธ์ที่วัดค่าได้เพิ่มขึ้นแต่อย่างใด

งานเชิงโต้ตอบที่ความหน่วง (latency) คือหัวใจสำคัญ ตารางเปรียบเทียบโมเดลของ Anthropic ระบุว่า Fable 5 มีความหน่วงสูงกว่า และไม่สามารถปิดฟังก์ชันการคิด (thinking) ได้ การใช้งานในช่องแชทหรือการเติมคำในโปรแกรมแก้ไขข้อความจะให้ความรู้สึกที่แย่กว่าเมื่อใช้โมเดลที่มีความสามารถสูงกว่า เนื่องจากผู้ใช้จะรับรู้ถึงระยะเวลาที่รอคอยก่อนที่จะรับรู้ถึงคุณภาพของคำตอบ

งานใดก็ตามที่ขึ้นอยู่กับเหตุการณ์หลังเดือนมกราคม 2026 ข้อมูลที่เชื่อถือได้ของ Fable 5 มีจุดตัดอยู่ที่เดือนมกราคม 2026 ในขณะที่ Opus 5 อยู่ที่เดือนพฤษภาคม 2026 โมเดลที่มีราคาสูงกว่ากลับมีข้อมูลที่เก่ากว่า ดังนั้นในคำถามที่ต้องการความสดใหม่ของข้อมูล คุณกำลังจ่ายเงินเพิ่มขึ้นสองเท่าเพื่อแลกกับความรู้ที่เก่ากว่า เว้นแต่คุณจะจัดหาเครื่องมือค้นหาหรือดึงข้อมูลภายนอกให้โมเดล

มีข้อจำกัดหนึ่งประการที่อยู่นอกเหนือเรื่องต้นทุนโดยสิ้นเชิง Fable 5 มีนโยบายการเก็บรักษาข้อมูล 30 วันและไม่สามารถใช้งานภายใต้นโยบายการไม่เก็บรักษาข้อมูลเลย (zero data retention) ได้ เนื่องจากถูกกำหนดให้เป็นโมเดลภายใต้ข้อบังคับ (Covered Model) หากข้อตกลงของคุณกำหนดให้ต้องไม่มีการเก็บรักษาข้อมูลเลย Fable 5 จะไม่ใช่ตัวเลือกไม่ว่าในราคาใดก็ตาม และไม่มีส่วนลดใดที่จะเปลี่ยนแปลงเงื่อนไขนี้ได้

สิ่งที่ repository แบบ fable-method แสดงให้เห็นและสิ่งที่ไม่ได้แสดง

ผู้ปฏิบัติงานได้เผยแพร่ repository ที่กลั่นกรองวิธีการทำงานของ Fable 5 ให้กลายเป็นทักษะที่โมเดลราคาถูกกว่าสามารถปฏิบัติตามได้ โดย fable-method repo ได้อธิบายถึงทักษะการคิด, ลูปการประสานงาน (orchestration loop) และตัวตรวจสอบแบบปรปักษ์ (adversarial verifier) ที่ทำการรันการตรวจสอบทุกรายการที่อ้างถึงซ้ำอีกครั้ง แทนที่จะอ่านรายงานของตัว agent เอง ซึ่งไฟล์ README ได้ระบุไว้อย่างชัดเจนว่า: "นี่คือการกลั่นกรองโดยชุมชน ไม่ใช่ผลงานจาก Anthropic"

ให้ถือว่ามันเป็นเช่นนั้นจริงๆ มันเป็นหลักฐานว่าผู้คนกำลังขับเคลื่อนโมเดลอย่างไร แต่ไม่ใช่เอกสารอธิบายว่าโมเดลทำงานอย่างไร ไม่มีสิ่งใดในนั้นที่ได้รับการตรวจสอบโดย Anthropic และยังมี fork ที่เกือบจะเหมือนกันหลายรายการที่มีการใช้ถ้อยคำต่างกัน ซึ่งเป็นสิ่งที่คาดหวังได้จากความรู้แบบบอกเล่า (folklore) ไม่ใช่ข้อกำหนดทางเทคนิค (spec)

สัญญาณที่ควรนำไปพิจารณาสำหรับการตัดสินใจด้านต้นทุนคือ ส่วนที่ผู้คนเห็นว่าคุ้มค่าที่จะคัดลอกนั้นเป็นขั้นตอนเชิงกระบวนการ (procedural) ได้แก่ การจำแนกประเภทงาน, การระบุชื่อการตรวจสอบที่พิสูจน์ว่างานเสร็จสิ้น, การรวบรวมหลักฐานก่อนตัดสินใจ จากนั้นจึงตรวจสอบด้วยการสังเกตแทนการอ่านสรุป โมเดลราคาถูกที่ได้รับรายการตรวจสอบที่ชัดเจนและขั้นตอนการยืนยันจะช่วยลดช่องว่างดังกล่าวได้บางส่วน ดังนั้นควรทำการทดลองนั้นด้วยชุดข้อมูลประเมินผลของคุณเองก่อนที่จะตัดสินใจใช้โมเดลราคาแพงเป็นมาตรฐาน ผลลัพธ์ขึ้นอยู่กับงานของคุณ ซึ่งเป็นเหตุผลว่าทำไมตัวเลขของผู้อื่นจึงไม่มีค่ามากนักสำหรับคุณ

ตรวจสอบตัวเลขของคุณเองก่อนอนุมัติงบประมาณ

  • อ่าน usage ในทุกการตอบกลับ และบันทึก output_tokens_details.thinking_tokens แยกต่างหากจากผลลัพธ์ที่แสดงผล การให้เหตุผลที่คุณไม่เคยเห็นคือรายการค่าใช้จ่ายที่มักทำให้คนประหลาดใจ
  • กำหนด effort อย่างชัดเจนแทนการยอมรับค่าเริ่มต้น และคงค่านี้ให้คงที่ตลอดการสนทนาที่ต้องอาศัย prompt caching
  • วาง prefix ที่คงที่ของคุณไว้หลัง cache breakpoint ก่อน การอ่านจาก cache ในราคาหนึ่งในสิบของราคา input พื้นฐานช่วยประหยัดค่าใช้จ่ายได้มากกว่าการลดรุ่นโมเดลส่วนใหญ่
  • ย้ายงานใดก็ตามที่ไม่ต้องการคำตอบทันทีไปไว้ที่ Batch API
  • ประเมินราคาทางเลือกอย่างตรงไปตรงมา การ เปรียบเทียบราคา API ระหว่าง Claude และ ChatGPT ด้วย workload ของคุณเองนั้นคุ้มค่าที่จะใช้เวลาช่วงบ่ายก่อนตัดสินใจผูกมัดในระยะยาว

หาก workload เป็น agent ที่รันบนเซิร์ฟเวอร์ของคุณเอง ตัวควบคุมที่สำคัญที่สุดจะอยู่นอกเหนือจากการเลือกโมเดล การควบคุมค่าใช้จ่ายของ agent บน VPS ครอบคลุมถึงการจำกัดลูปและเพดานการใช้จ่ายที่จะหยุดเซสชันที่ทำงานผิดปกติ และ จุดที่ Claude Code ใช้โทเค็นจริง ๆ จะอธิบายตัวเลขที่คุณจะเห็นในแดชบอร์ดการใช้งานของคุณ

FAQ

Claude Fable 5 มีค่าใช้จ่ายต่อล้านโทเค็นเท่าไร?

Claude Fable 5 มีราคาอยู่ที่ $10 ต่อล้านโทเค็นขาเข้า และ $50 ต่อล้านโทเค็นขาออกบน Claude API โดยอ้างอิงจากหน้าราคาของ Anthropic ณ วันที่ 3 สิงหาคม 2026 การอ่านจากแคชมีค่าใช้จ่าย $1 ต่อล้านโทเค็น ซึ่งเป็นหนึ่งในสิบของอัตราขาเข้าปกติ Batch API มอบส่วนลด 50% สำหรับทั้งสองฝั่ง ทำให้เหลือ $5 และ $25 ต่อล้านโทเค็นสำหรับการประมวลผลแบบอะซิงโครนัส การเก็บข้อมูลการอนุมานไว้ภายในสหรัฐอเมริกาด้วยพารามิเตอร์ inference_geo จะเพิ่มตัวคูณ 1.1 เท่าให้กับทุกหมวดหมู่

Claude Fable 5 รวมอยู่ในแพ็กเกจสมาชิก Claude Pro หรือไม่?

หน้า Claude Fable ของ Anthropic ระบุว่าโมเดลนี้พร้อมใช้งานสำหรับผู้ใช้ระดับ Pro, Max, Team และ Enterprise โดยไม่ได้ระบุถึงแผนฟรี การเข้าถึงที่รวมอยู่ในแพ็กเกจนั้นไม่จำกัด ผู้ใช้บางกลุ่มเข้าถึง Fable ได้ตามสัดส่วนของขีดจำกัดการใช้งานรายสัปดาห์ และบางกลุ่มเข้าถึงผ่านเครดิตการใช้งาน ซึ่งข้อกำหนดนี้มีการเปลี่ยนแปลงมากกว่าหนึ่งครั้งในช่วงเดือนกรกฎาคม 2026 โปรดอ่านแถวที่ระบุว่า Fable ในตารางเปรียบเทียบแผนบนหน้าราคาของ Anthropic ในวันที่คุณตัดสินใจ แทนการเชื่อตัวเลขจากบทความ เมื่อใช้โควตาที่รวมอยู่ในแพ็กเกจหมดแล้ว การใช้งานเพิ่มเติมจะถูกเรียกเก็บเงินตามอัตราของ API

ทำไมค่าใช้จ่าย Claude Fable 5 ของฉันถึงสูงกว่าปริมาณผลลัพธ์ที่เห็น?

ฟีเจอร์ Adaptive thinking จะเปิดใช้งานตลอดเวลาสำหรับ Claude Fable 5 โดยโทเค็นการคิดจะถูกเรียกเก็บเงินในฐานะโทเค็นขาออก และกระบวนการคิดแบบดิบจะไม่ถูกส่งกลับมาให้เห็น เมื่อตั้งค่า thinking.display ไว้ที่ค่าเริ่มต้นคือ omitted คุณจะเห็นช่องการคิดที่ว่างเปล่าในขณะที่ต้องจ่ายเงินสำหรับทุกโทเค็นการใช้เหตุผลที่อยู่เบื้องหลัง ให้ตรวจสอบ usage.output_tokens_details.thinking_tokens ในการตอบกลับเพื่อดูการแบ่งสัดส่วน และโปรดทราบว่าเมื่อทำการสตรีม ข้อมูลนี้จะปรากฏเฉพาะในเหตุการณ์ message_delta สุดท้ายเท่านั้น ให้ลดระดับ effort ลงหากสัดส่วนของการใช้เหตุผลต่อคำตอบสูงเกินกว่าที่งานนั้นต้องการ

ฉันควรใช้ Claude Fable 5 หรือ Claude Opus 5?

Claude Opus 5 มีค่าใช้จ่ายต่อโทเค็นถูกกว่าครึ่งหนึ่งและมีจุดตัดของความรู้ที่เชื่อถือได้ใหม่กว่า คือเดือนพฤษภาคม 2026 เทียบกับเดือนมกราคม 2026 ของ Fable 5 ให้เริ่มต้นที่ Opus 5 และขยับขยายเมื่อพบว่างานนั้นล้มเหลว หรือเมื่อคำตอบที่ผิดมีราคาแพงกว่าส่วนต่างของราคา Fable 5 เป็นตัวเลือกที่เหมาะสมสำหรับงานตัวแทนที่มีระยะเวลายาวนาน ซึ่งการตัดสินใจที่ผิดพลาดเพียงครั้งเดียวอาจทำให้ต้องเสียเวลาแก้ไขนานหลายชั่วโมง และสำหรับงานเฉพาะกิจที่ค่าพรีเมียมจะถูกรวมอยู่ในใบแจ้งหนี้เดียว แทนที่จะต้องจ่ายเพิ่มในทุกคำขอตลอดไป

#claude#fable#model-selection#pricing#tokens