SSD Nodes Learn 🎉 VPS החל מ־$4.99/חודש
מדריכים Matt Connorמאת Matt Connor

Claude Fable 5: מחיר ומתי כדאי להשתמש בו

Claude Fable 5 עולה 10 דולר למיליון טוקני קלט ו־50 דולר למיליון טוקני פלט. כך מחירי המחירון מתורגמים למשימות שאתם באמת מריצים.

כמה עולה Claude Fable 5?

Claude Fable 5 עולה $10 לכל מיליון טוקני קלט ו־$50 לכל מיליון טוקני פלט ב־Claude API. אלה מחירי המחירון שפרסמה Anthropic, כפי שנלקחו מדף התמחור ב־3 באוגוסט 2026. מזהה המודל ב־API הוא claude-fable-5. המודל הפך לזמין לכלל המשתמשים ב־9 ביוני 2026 ב־Claude API, ב־Amazon Bedrock, ב־Claude Platform on AWS, ב־Google Cloud וב־Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

אפשר להבין זאת כסולם מחירים. מחיר המחירון של Fable 5 כפול ממחיר Claude Opus 5, פי 5 מהמחיר הנוכחי של Claude Sonnet 5, ופי 10 ממחיר Claude Haiku 4.5. היחס זהה בשני רכיבי החשבון, משום שכל מודל בתרשים מתמחר פלט בדיוק פי 5 ממחיר הקלט שלו. לכן, אם ידועה חלוקת טוקני הקלט והפלט של משימה, אפשר להמיר מחיר אחד לכל מחיר אחר באמצעות כפל.

תאריך אחד משנה את החישוב. Sonnet 5 מוצע בתמחור השקה של $2 ו־$10 לכל מיליון טוקנים עד 31 באוגוסט 2026. החל מ־1 בספטמבר 2026 מחיר המחירון שלו יהיה $3 ו־$15. המחיר של Fable 5 עצמו אינו משתנה, ולכן הפער בינו לבין Sonnet 5 מצטמצם באותו יום מפי 5 למעט יותר מפי 3. אם אתם מכינים תקציב לסתיו, השתמשו במחירי Sonnet המאוחרים יותר.

ההנחות, והמכפיל היחיד שפועל בכיוון ההפוך

שמירת הנחיות במטמון היא המנוף המשמעותי ביותר. קריאה מהמטמון עולה עשירית ממחיר קלט בסיסי, כלומר $1 למיליון טוקנים ב־Fable 5. כתיבה למטמון יקרה מטוקן קלט רגיל: פי 1.25 מהמחיר הבסיסי במטמון לחמש דקות, ופי 2 מהמחיר הבסיסי במטמון לשעה אחת. מטמון לחמש דקות מחזיר את עלותו לאחר קריאה אחת בלבד, ומטמון לשעה אחת לאחר שתי קריאות. החישוב הזה הוא כל הסיבה לבדוק מתי שמירת הנחיות במטמון מתחילה להשתלם לפני שמפעילים אותה בכל מקום.

ה־Batch API מעניק הנחה של 50% על שני הצדדים, ולכן עבודה באצווה עם Fable 5 עולה $5 ו־$25 למיליון טוקנים. בקשות אצווה הן אסינכרוניות, ולכן הדבר מסייע רק לעבודה שאינה דורשת תשובה מיידית. שתי ההנחות מצטברות, ולכן משימה שמשתמשת במטמון ומעובדת באצווה זולה בשני המדדים.

חלון ההקשר של 1M טוקנים כלול בתעריפים הרגילים ב־Claude 4.6 ובמודלים מאוחרים יותר. אין תוספת תשלום על הקשר ארוך, ולכן בקשה של 900k טוקנים מחויבת באותו תעריף לטוקן כמו בקשה של 9k טוקנים.

המכפיל שמעלה את החשבון הוא מיקום הנתונים. הגדרת inference_geo: "us" כך שההיסק יישאר בתוך ארצות הברית מחילה מכפיל של פי 1.1 על כל קטגוריית טוקנים, כולל קריאות מהמטמון וכתיבות למטמון. השאירו את ניתוב ברירת המחדל הגלובלי, אלא אם חוזה מחייב אחרת.

כלל חיוב אחד ייחודי למודל הזה. ב־Fable 5 כלולים מסווגי בטיחות שיכולים לדחות בקשה. במקרה כזה ה־Messages API מחזיר את stop_reason: "refusal" כתשובת HTTP 200 מוצלחת ולא כשגיאה, ולא תחויבו עבור בקשה שנדחתה לפני שנוצר פלט כלשהו. אם תנסו שוב את אותה הנחיה במודל Claude אחר, זיכוי fallback מחזיר את עלות מטמון ההנחיה של המעבר, ולכן אינכם משלמים כדי לחמם את אותו מטמון פעמיים.

אילו מסלולים כוללים את Claude Fable 5?

נכון ל־3 באוגוסט 2026, בדף של Anthropic בנושא Claude Fable מצוין שהמודל זמין למשתמשי Pro, Max, Team ו־Enterprise. המסלול החינמי אינו מוזכר. למפתחים, המודל זמין בדרך כלל ב־Claude API ובאמצעות ספקי הענן המפורטים לעיל.

זמינות במסגרת מסלול אינה זהה להכללה ללא הגבלה. טבלת השוואת המסלולים בדף התמחור של Anthropic מגבילה את Fable באמצעות חלק ממכסת השימוש השבועית בחלק מסוגי המנויים, ובאמצעות קרדיטים לשימוש באחרים. הסדר הזה השתנה יותר מפעם אחת במהלך יולי 2026. בהודעה הרשמית של Anthropic על החזרת Fable 5 נכתב שהמודל נכלל בעד 50% ממכסת השימוש השבועית עד 7 ביולי 2026 במסלולי Pro, Max, Team ובמסלולי Enterprise נבחרים, ולאחר מכן נדרש שימוש בקרדיטים. דיווחים שפורסמו בהמשך יולי תיארו הארכות נוספות והפרדה בין סוגי מנויים.

לכן, בדף הזה לא תופיע מכסה נפרדת לכל מסלול. אף נתון שפורסם במהלך אותו חודש לא נשאר תקף למשך שבועיים, ונתון שאינו מעודכן גרוע יותר מהיעדר נתון. פתחו את השורה המסומנת Fable בטבלת השוואת המסלולים ביום שבו אתם מקבלים את ההחלטה, והתייחסו לכל נתון בכתבת חדשות כאל נתון שאינו מעודכן.

מה שנשאר יציב הוא תעריף ה־API. בכל מסלול, לאחר שמכסת השימוש הכלולה נוצלה, שימוש נוסף ב־Fable 5 מחויב לפי המחירים שבטבלה לעיל. לכן, בכל מקרה, רשימת המחירים היא הנתון שעל פיו יש לתכנן, כפי שמתקבל גם כאשר משווים את חיוב ה־API למנוי עבור כל מודל אחר של Claude. אם עדיין לא בחרתם רמת שירות, התחילו ב־בדיקה איזה מסלול Claude מתאים לשימוש שלכם.

מדוע החשבון שלך גבוה יותר מכפי שמרמז יחס המחירים

שני מנגנונים מתועדים גורמים לכך ש־Fable 5 עולה יותר מכפי שמרמיה השוואת מחירים ישירה.

הראשון הוא ה־tokenizer. Fable 5 משתמש ב־tokenizer שהוצג עם Claude Opus 4.7. בהשוואה למודלים שפורסמו לפני Opus 4.7, אותו טקסט מפיק בערך 30% יותר tokens, והגידול המדויק תלוי בתוכן. Haiku 4.5 קודם ל־tokenizer הזה, ולכן הפער של פי עשרה ברשימת המחירים קרוב יותר לפי שלושה עשר כאשר מזינים לשני המודלים את אותו קטע טקסט. Sonnet 5 משתמש ב־tokenizer החדש יותר, ולכן ההשוואה בין Fable ל־Sonnet לפי token הוגנת. ההשוואה בין Fable ל־Haiku אינה הוגנת.

השני הוא thinking. Adaptive thinking מופעל תמיד ב־Fable 5, ו־thinking: {"type": "disabled"} אינו נתמך. Tokens של thinking מחויבים כ־output tokens, בתעריף המלא של output. ה־chain of thought הגולמי לעולם אינו מוחזר במודל הזה, ו־thinking.display מוגדר כברירת מחדל ל־"omitted", כלומר תשובה גלויה קצרה עשויה לכלול מספר גדול של output tokens מחויבים. התיעוד של Anthropic קובע זאת במפורש: מספר ה־output tokens המחויבים אינו תואם למספר ה־tokens הגלויים בתגובה.

בדקו את הפירוט במקום לנחש. השדה usage.output_tokens_details.thinking_tokens מדווח כמה מה־output tokens המחויבים הוקצו ל־reasoning:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

בדוגמה הזו, שנלקחה מתיעוד ה־thinking של Anthropic, 312 מתוך 348 ה־output tokens המחויבים היו tokens של reasoning שאיש לא ראה. בעת שימוש ב־streaming, הפירוט הזה מגיע רק באירוע message_delta האחרון, ולכן client שמפסיק לקרוא לאחר קטע ה־text האחרון לעולם לא יתעד אותו.

הבקרה היא effort, והיא מוגדרת ב־output_config.effort, עם הרמות low, medium, high (ברירת המחדל), xhigh ו־max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

ההנחיה של Anthropic עבור מודל זה היא להתחיל ב־high, לעלות ל־xhigh רק עבור משימות שהיכולת בהן רגישה במיוחד, ולרדת ל־medium או ל־low עבור עבודה שגרתית, משום שמאמץ נמוך יותר ב־Fable 5 מנצח לעיתים קרובות את xhigh במודלים קודמים. יש לכך שתי מלכודות. שינוי המאמץ בין בקשות מבטל את ה־prompt cache, משום שערך המאמץ שנפתר נכתב לתוך ה־prompt. לכן בחרו רמה לכל עומס עבודה ושמרו עליה קבועה. בנוסף, max_tokens הוא מגבלה קשיחה על סך ה־output, הכולל את ה־thinking ואת טקסט התגובה, ולכן מגבלה שנקבעה עבור תשובה ללא thinking תגרום לקטיעה. הופעת stop_reason: "max_tokens" פירושה שעליכם להגדיל את המגבלה או להפחית את המאמץ.

עלות לכל משימה שהושלמה, לא עלות לכל טוקן

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

q:task_cost:row_count השורות האלה הן חישוב אריתמטי, לא אמת מידה. התעריפים מפורסמים. כמויות הטוקנים הן הנחות, ועליכם להחליף אותן בנתונים מהשימוש שלכם. סשן קידוד במבנה של השורה האמצעית עולה $5.00 עם Fable 5, לעומת $1.00 עם Sonnet 5. הריצה הארוכה עולה $40.00 לעומת $8.00. העמודה של Haiku בשורה האחרונה היא חישוב אריתמטי בלבד: ל־Haiku 4.5 יש חלון הקשר של 200k טוקנים, ולכן הוא אינו יכול להכיל את המשימה הזאת כלל.

עלות לטוקן היא יחידת המדידה הלא נכונה לקבלת החלטה. עלות למשימה שהושלמה היא העלות לכל ניסיון כפול מספר הניסיונות. בתעריפים של היום, ניסיון אחד עם Fable 5 עולה כמו חמישה ניסיונות עם Sonnet 5, ולכן מספר ניסיונות חוזרים לבדו כמעט אף פעם אינו מצדיק שדרוג. Sonnet יצטרך להיכשל יותר מארבע פעמים מתוך חמש לפני שהמסלול הזול יפסיד מבחינת כמות הטוקנים.

מה שמצדיק את השדרוג הוא כל מה שחשבון הטוקנים אינו כולל. הפער בין שתי הריצות הארוכות בתרשים קטן מעלות של שעת עבודה אחת של מהנדס ברוב השווקים. אם המודל היקר חוסך שעה של בדיקה, או מונע הגירה שגויה אחת שתצטרכו לאחר מכן לפרק ולתקן, הוא כבר החזיר את עלותו — אף שהחיסכון אינו מופיע בחשבון. בצעו את ההשוואה לפי עלות כספית לכל תוצאה שאושרה, וכללו בסכום הכולל גם את הזמן שלכם. הבנת התמורה האמיתית של מיליון טוקנים הופכת את ההערכה הזאת למופשטת הרבה פחות.

שלוש משימות שבהן Claude Fable 5 מצדיק את עלותו

הרצות של סוכן לטווח ארוך, שבהן טעות יקרה לתיקון. Fable 5 מיועד לעבודה שנמדדת בשעות: חלון הקשר של 1M טוקנים, עד 128k טוקנים בפלט לכל בקשה, ורמת מאמץ xhigh המיועדת למשימות שנמשכות יותר משלושים דקות, עם תקציבי טוקנים של מיליונים. השוו את עלות ההרצה לעבודת הניקוי הנדרשת לאחר שסוכן בוחר מסלול שגוי בשלב 40, ואיש אינו מבחין בכך עד שלב 300.

העברה או ביקורת שמבצעים פעם אחת על בסיס קוד גדול. בעבודה חד־פעמית אין נפח שמאפשר לפזר את העלות, ולכן התוספת לכל טוקן מופיעה בחשבונית אחת, וייתכן שכל המשימה תיכלל בחלון הקשר יחיד. אם אפשר להריץ אותה באופן אסינכרוני, ה־Batch API מפחית את העלות בחצי, ל־$25 לכל מיליון טוקנים בפלט.

משימה שמודל זול יותר כבר נכשל בה פעמיים. שני ניסיונות כושלים, בתוספת הזמן שהשקעתם בניפוי שגיאות, עולים יותר מניסיון אחד של Fable בהיקפים המוצגים בתרשים שלמעלה. מעבר למודל מתקדם יותר הוא המסלול הזול יותר, ולשם כך נועדה היררכיית המודלים. אם אתם עדיין בוחרים בין רמות באופן כללי, השוואת היכולות בין רמות המודלים של Claude עונה על שאלה אחרת מזו שבעמוד זה.

שלוש משימות שבהן Sonnet 5 או Haiku 4.5 הם התשובה הכנה

סיווג וחילוץ בנפח גבוה. במשימות האלה מודדים תפוקה ועלות ליחידה, ותקרת האיכות נמוכה מספיק כדי שמודל זול יגיע אליה. כאשר משימה ש־Haiku 4.5 משלים בהצלחה עולה פי 10, Fable 5 אינו מספק תועלת מדידה.

עבודה אינטראקטיבית שבה זמן האחזור הוא המוצר. טבלת המודלים של Anthropic מציינת שזמן האחזור היחסי של Fable 5 ארוך יותר, ואי אפשר להשבית את החשיבה. תיבת צ'אט או השלמה בעורך מרגישות איטיות יותר במודל בעל היכולות הגבוהות יותר, משום שהמשתמשים מבחינים בהמתנה לפני שהם מבחינים באיכות.

כל דבר שתלוי באירועים שהתרחשו אחרי ינואר 2026. מועד חיתוך הידע האמין של Fable 5 הוא ינואר 2026. אצל Opus 5 המועד הוא מאי 2026. המודל היקר יותר מעודכן פחות, ולכן בשאלות הנוגעות לעדכניות משלמים פי 2 על ידע ישן יותר, אלא אם כן מספקים לו כלי חיפוש או אחזור.

מגבלה אחת אינה קשורה כלל לעלות. Fable 5 שומר נתונים במשך 30 יום ואינו זמין תחת מדיניות של zero data retention, משום שהוא מוגדר כ־Covered Model. אם ההסכם שלכם מחייב zero retention, Fable 5 אינו אפשרי בכל מחיר, והנחה כלשהי לא תשנה זאת.

מה שמאגרי fable-method מראים, ומה שאינם מראים

אנשי מקצוע פרסמו מאגרים שמזקקים את האופן שבו גישות Fable 5 פועלות לכדי skills שמודל זול יותר יכול לבצע. מאגר fable-method מתאר skill של חשיבה, לולאת תזמור ו־verifier יריב שמריץ מחדש כל בדיקה שנטענה, במקום לקרוא את הדוח של ה־agent עצמו. קובץ ה־README שלו מציין זאת ישירות: "זהו זיקוק של הקהילה, ולא תוצר של Anthropic."

יש להתייחס אליו בדיוק כך. הוא מעיד על האופן שבו אנשים מנחים את המודל, ואינו תיעוד של אופן פעולתו. שום דבר בו לא אומת על ידי Anthropic, וקיימים כמה forks כמעט זהים בניסוחים שונים. זהו מאפיין צפוי של מסורת שעוברת בין אנשים, ולא של spec.

המסקנה הרלוונטית להחלטה על עלות היא שהחלקים שאנשים מצאו ראויים להעתקה הם פרוצדורליים. סווגו את המשימה, הגדירו את הבדיקה שמוכיחה שהיא הושלמה, אספו ראיות לפני קבלת החלטה, ולאחר מכן אמתו באמצעות תצפית ולא באמצעות קריאת סיכום. מודל זול יותר שקיבל checklist מפורש ושלב אימות יכול לצמצם חלק מהפער. לכן הריצו את הניסוי הזה על מערך ההערכה שלכם לפני שתקבעו שימוש קבוע במודל היקר. התוצאה תלויה במשימות שלכם, ולכן למספר של מישהו אחר יש ערך מוגבל עבורכם.

בדקו את המספרים שלכם לפני התחייבות לתקציב

  • קראו את usage בכל תגובה, ותעדו את output_tokens_details.thinking_tokens בנפרד מהפלט הגלוי. ההיסק שאינכם רואים הוא סעיף העלות שמפתיע משתמשים.
  • הגדירו את effort במפורש במקום לקבל את ברירת המחדל, ושמרו עליו קבוע בתוך כל שיחה שמסתמכת על שמירת prompt במטמון.
  • הציבו תחילה את הקידומת היציבה שלכם מאחורי נקודת שמירה במטמון. קריאה מהמטמון במחיר של עשירית ממחיר קלט בסיסי חוסכת יותר מרוב המעברים למודלים זולים יותר.
  • העבירו ל־Batch API כל משימה שאינה דורשת תשובה מיידית.
  • תמחרו את החלופה באופן מציאותי. השוואת תמחור ה־API של Claude ושל ChatGPT לפי עומס העבודה שלכם מצדיקה אחר צהריים של בדיקה לפני התחייבות ארוכת טווח.

אם עומס העבודה הוא agent שפועל בשרת שלכם, אמצעי הבקרה החשובים ביותר נמצאים מחוץ לבחירת המודל. שמירה על עלויות agent בשליטה ב־VPS מתארת את מגבלות הלולאה ואת תקרות ההוצאה שעוצרות session שיצא משליטה, ו־היכן Claude Code באמת צורך tokens מסביר את המספרים שתראו בלוח השימוש שלכם.

FAQ

כמה עולה Claude Fable 5 לכל מיליון טוקנים?

המחיר של Claude Fable 5 הוא $10 לכל מיליון טוקני קלט ו־$50 לכל מיליון טוקני פלט ב־Claude API, לפי בדיקה בדף התמחור של Anthropic ב־3 באוגוסט 2026. קריאת מטמון עולה $1 לכל מיליון טוקנים, כלומר עשירית ממחיר קלט הבסיס. ‏Batch API מעניק הנחה של 50% בשני הצדדים, ולכן המחיר לעבודה אסינכרונית הוא $5 לכל מיליון טוקני קלט ו־$25 לכל מיליון טוקני פלט. השארת ההסקה בתוך ארצות הברית באמצעות הפרמטר inference_geo מוסיפה מכפיל של 1.1 לכל קטגוריית תמחור.

האם Claude Fable 5 כלול במינוי Claude Pro?

בדף של Claude Fable מטעם Anthropic מצוין שהמודל זמין למשתמשי Pro, Max, Team ו־Enterprise, אך התוכנית החינמית אינה מוזכרת. הגישה הכלולה אינה בלתי מוגבלת. בחלק מהמינויים Fable נצרך מתוך מכסות שימוש שבועיות, ובאחרים באמצעות קרדיטים לשימוש. הסדר הזה השתנה יותר מפעם אחת במהלך יולי 2026. קראו את השורה שכותרתה Fable בטבלת השוואת התוכניות בדף התמחור של Anthropic ביום קבלת ההחלטה, במקום להסתמך על נתון ממאמר. לאחר ניצול המכסה הכלולה, השימוש הנוסף מחויב לפי תעריף ה־API.

מדוע החשבון שלי עבור Claude Fable 5 גבוה יותר מכפי שהפלט הגלוי מרמז?

חשיבה אדפטיבית מופעלת תמיד ב־Claude Fable 5. טוקני החשיבה מחויבים כטוקני פלט, וה־chain of thought הגולמי לעולם אינו מוחזר. כאשר thinking.display מוגדר לערך ברירת המחדל omitted, מוצג שדה חשיבה ריק, אף שהתשלום כולל כל טוקן reasoning שנוצר מאחוריו. קראו את usage.output_tokens_details.thinking_tokens בתגובה כדי לראות את החלוקה, ושימו לב שבמצב streaming הוא מגיע רק באירוע message_delta האחרון. הורידו את רמת effort אם היחס בין ה־reasoning לתשובה גבוה מהנדרש למשימה.

האם כדאי להשתמש ב־Claude Fable 5 או ב־Claude Opus 5?

Claude Opus 5 עולה מחצית לכל טוקן, ויש לו cutoff אמין ועדכני יותר של הידע: מאי 2026, לעומת ינואר 2026 עבור Fable 5. התחילו ב־Opus 5 והסלימו ל־Fable כאשר משימה נכשלת בו, או כאשר עלות תשובה שגויה גבוהה מהפרש המחיר. Fable 5 מתאים לעבודה ממושכת של סוכנים, שבה ענף שגוי אחד גורר שעות של ניקוי, וכן למשימות חד־פעמיות שבהן התוספת מחויבת בחשבון יחיד במקום בכל בקשה, ללא הגבלת זמן.

#claude#fable#model-selection#pricing#tokens