SSD Nodes Learn Hosting plans →
מדריכים Matt Connorמאת Matt Connor · עודכן 2026-09-06

Claude Fable 5: מחיר ומתי כדאי להשתמש בו

Claude Fable 5 עולה $10 למיליון אסימוני קלט ו־$50 למיליון פלט. הסבר מעשי למחירון, להשוואה ל־Sonnet ולשינוי המחיר ב־1 בספטמבר 2026.

מה המחיר של Claude Fable 5?

המחיר של Claude Fable 5 הוא $10 למיליון אסימוני קלט ו־$50 למיליון אסימוני פלט ב־Claude API. אלה מחירי המחירון שפורסמו על ידי Anthropic, כפי שנקראו מדף התמחור ב־3 באוגוסט 2026. מזהה המודל ב־API הוא claude-fable-5. המודל הפך לזמין באופן כללי ב־9 ביוני 2026 ב־Claude API, ב־Amazon Bedrock, ב־Claude Platform on AWS, ב־Google Cloud וב־Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

אפשר להבין זאת כסולם מחירים. המחירון של Fable 5 גבוה פי 2 מזה של Claude Opus 5, פי 5 מהמחיר הנוכחי של Claude Sonnet 5, ופי 10 מזה של Claude Haiku 4.5. היחס זהה בשני סוגי החיוב, משום שכל המודלים בטבלה מתמחרים פלט בדיוק פי 5 ממחיר הקלט שלהם. לכן, אם ידוע היחס בין אסימוני הקלט לאסימוני הפלט של משימה, אפשר להמיר מחיר אחד לאחר באמצעות כפל.

תאריך אחד משנה את החישוב. Claude Sonnet 5 מתומחר במחיר השקה של $2 ו־$10 למיליון אסימונים עד 31 באוגוסט 2026. החל מ־1 בספטמבר 2026, מחיר המחירון שלו יהיה $3 ו־$15. המחיר של Fable 5 עצמו אינו משתנה, ולכן הפער בין שני המודלים יצטמצם באותו יום מפי 5 לקצת יותר מפי 3. אם אתם מכינים תקציב לסתיו, השתמשו במחירי Sonnet המאוחרים יותר.

ההנחות, והמכפיל היחיד שפועל בכיוון ההפוך

שמירת prompts במטמון היא מנוף החיסכון המשמעותי ביותר. קריאה מהמטמון עולה עשירית ממחיר קלט רגיל, כלומר $1 לכל מיליון טוקנים ב־Fable 5. כתיבה למטמון יקרה מטוקן קלט רגיל: פי 1.25 מהמחיר הבסיסי עבור מטמון לחמש דקות, ופי 2 מהמחיר הבסיסי עבור מטמון לשעה. מטמון לחמש דקות מחזיר את עלותו כבר לאחר קריאה אחת, ומטמון לשעה לאחר שתי קריאות. זהו כל הבסיס לחישוב של נקודת האיזון של שמירת prompts במטמון לפני שמפעילים אותה בכל מקום.

ה־Batch API מעניק הנחה של 50% בשני הצדדים, ולכן עיבוד באצווה ב־Fable 5 עולה $5 עבור קלט ו־$25 עבור פלט, לכל מיליון טוקנים. בקשות אצווה הן אסינכרוניות, ולכן הדבר מועיל רק לעיבוד שאינו דורש תשובה מיידית. שתי ההנחות מצטברות, ולכן משימה שמשתמשת גם במטמון וגם באצווה זולה בשני המדדים.

חלון ההקשר של 1M טוקנים כלול בתעריפים הרגילים ב־Claude 4.6 ובמודלים מאוחרים יותר. אין תוספת מחיר עבור הקשר ארוך, ולכן בקשה של 900k טוקנים מחויבת באותו תעריף לטוקן כמו בקשה של 9k טוקנים.

המכפיל שמגדיל את החשבון הוא מיקום הנתונים. הגדרת inference_geo: "us" כך שהסקת המודל תתבצע בתוך ארצות הברית מוסיפה מכפיל של פי 1.1 לכל קטגוריית טוקנים, כולל קריאות מהמטמון וכתיבות למטמון. השאירו את הניתוב הגלובלי כברירת מחדל, אלא אם חוזה מחייב אחרת.

כלל חיוב אחד ייחודי למודל הזה. Fable 5 כולל מסווגי בטיחות שיכולים לדחות בקשה. במקרה כזה, ה־Messages API מחזיר את stop_reason: "refusal" כתשובת HTTP 200 מוצלחת ולא כשגיאה, ואינכם מחויבים עבור בקשה שנדחתה לפני שנוצר פלט כלשהו. אם תנסו שוב את אותו prompt במודל Claude אחר, זיכוי fallback מחזיר את עלות מטמון ה־prompt של המעבר, ולכן אינכם משלמים כדי לחמם את אותו מטמון פעמיים.

אילו תוכניות כוללות את Claude Fable 5?

נכון ל־3 באוגוסט 2026, בדף Claude Fable של Anthropic מצוין שהמודל זמין למשתמשי Pro, Max, Team ו־Enterprise. התוכנית החינמית אינה מוזכרת. Pro היא התוכנית הזולה ביותר למושב מתוך הרשימה, ולכן העלות של Pro והמגבלות שבהן השימוש נעצר קובעות את רף המחיר לכל מסלול מנוי ל־Fable. אם הגישה ל־Fable היא הסיבה העיקרית לשדרוג, בדקו תחילה אם משתלם לשלם על מושב Pro בהתאם לדפוס השימוש האישי שלכם, משום שמכסת Fable קטנה אינה מצדיקה לבדה את המנוי. למפתחים, המודל זמין בדרך כלל דרך Claude API ובאמצעות שוקי הענן שפורטו לעיל. במסלול הזה אין שכבה חינמית, ולכן הזיכוי הקטן ש־Anthropic מעניקה בעת ההרשמה הוא כל מה שתקבלו לפני תחילת החיוב לפי שימוש.

זמינות במסגרת תוכנית אינה שקולה להכללה ללא הגבלה. גם מינוי אינו נמדד באותו אופן כמו ה־API, משום ש־למושב Pro אין כלל מכסת טוקנים שפורסמה, ובמקום זאת השימוש נספר בהודעות במהלך חלון מתגלגל. לכן שום רכיב בתוכנית אינו ניתן להמרה ישירה לנתונים לכל מיליון טוקנים שהוצגו לעיל.

טבלת השוואת התוכניות בדף התמחור של Anthropic מגבילה את Fable לפי חלק ממגבלות השימוש השבועיות בחלק מהמושבים, ולפי קרדיטי שימוש במושבים אחרים. הסדר הזה השתנה יותר מפעם אחת במהלך July 2026. בהודעה הרשמית של Anthropic על ההשקה מחדש של Fable 5 נכתב כי המודל יהיה זמין בהיקף של עד 50% ממגבלות השימוש השבועיות עד 7 July 2026 במסגרת תוכניות Pro, Max, Team ותוכניות Enterprise נבחרות, ולאחר מכן באמצעות קרדיטי שימוש. דיווחים שפורסמו בהמשך July תיארו הארכות נוספות והבחנה בין סוגי מושבים.

לכן הדף הזה לא יציג מגבלה נפרדת לכל תוכנית. שום נתון שפורסם במהלך אותו חודש לא נשאר תקף למשך שבועיים, ונתון מיושן כאן גרוע יותר מהיעדר נתון. פתחו את השורה Fable בטבלת השוואת התוכניות ביום שבו אתם מחליטים, והתייחסו לכל מספר שמופיע בכתבת חדשות כאל נתון שאינו עדכני. אם רכשתם מושב לצורך גישה ל־Fable והמכסה מתבררת כנמוכה מזו שהטבלה גרמה לכם לצפות לה, חזרה לתוכנית נמוכה יותר לפני החידוש הבא משאירה את החודש שכבר שילמתם עליו ללא שינוי.

מה שנשאר יציב הוא תעריף ה־API. בכל מסלול, לאחר שמנצלים את המכסה הכלולה, כל שימוש נוסף ב־Fable 5 מחויב לפי המחירים שבטבלה לעיל. Enterprise מבהירה את המבנה הזה, משום ש־דמי המושב של Enterprise מעניקים גישה, אך עלות ה־tokens עדיין מחושבת לפי תעריפי ה־API בנוסף להם. לכן רשימת המחירים היא הנתון שעליו יש לבסס את התכנון בכל מקרה. זו גם המסקנה שמתקבלת כאשר משווים חיוב לפי API למנוי עבור כל מודל אחר של Claude. אם עדיין לא בחרתם רמת תוכנית, התחילו מ־איזו תוכנית Claude מתאימה לדפוס השימוש שלכם. אם המושב ישמש גם כעוזר היומיומי שלכם, ולא רק כדרך לקבלת גישה ל־Fable, כדאי לבדוק כיצד מחירי תוכניות Claude משתווים לאלה של ChatGPT לפני שמתחייבים לאחת מהן.

מדוע החשבון גבוה יותר מכפי שיחס המחירים מרמז

שני מנגנונים מתועדים גורמים לכך ש־Fable 5 יקר יותר מכפי שהשוואת מחירים ישירה מרמזת.

הראשון הוא ה־tokenizer. ‏Fable 5 משתמש ב־tokenizer שהוצג עם Claude Opus 4.7. בהשוואה למודלים שפורסמו לפני Opus 4.7, אותו טקסט מפיק בערך 30% יותר tokens, והגידול המדויק תלוי בתוכן. Haiku 4.5 קודם ל־tokenizer הזה, ולכן הפער של פי 10 במחירון קרוב יותר לפי 13 כאשר מזינים לשני המודלים אותו קטע טקסט. Sonnet 5 משתמש ב־tokenizer החדש יותר, ולכן ההשוואה בין Fable ל־Sonnet לפי token היא הוגנת. ההשוואה בין Fable ל־Haiku אינה הוגנת.

השני הוא ה־thinking. ‏Adaptive thinking מופעל תמיד ב־Fable 5, ו־thinking: {"type": "disabled"} אינו נתמך. Tokens של thinking מחויבים כ־output tokens, בתעריף המלא של output. שרשרת המחשבה הגולמית אינה מוחזרת לעולם במודל הזה, ו־thinking.display מוגדר כברירת מחדל ל־"omitted", כלומר תשובה קצרה ונראית לעין יכולה לכלול מספר גדול של output tokens מחויבים. התיעוד של Anthropic מציין זאת במפורש: מספר ה־output tokens המחויבים אינו תואם למספר ה־tokens הנראים בתשובה.

קראו את הפירוט במקום לנחש. השדה usage.output_tokens_details.thinking_tokens מדווח כמה output tokens מחויבים הוקצו ל־reasoning:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

בדוגמה זו, שנלקחה מתיעוד ה־thinking של Anthropic, 312 מתוך 348 ה־output tokens המחויבים שימשו ל־reasoning שאיש לא ראה. בעת streaming, הפירוט הזה מגיע רק באירוע message_delta האחרון, ולכן client שמפסיק לקרוא אחרי מקטע הטקסט האחרון לעולם לא יתעד אותו.

הבקרה היא effort, והיא מוגדרת בערך output_config.effort, עם הרמות low, medium, high (ברירת המחדל), xhigh ו־max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

ההנחיה של Anthropic למודל הזה היא להתחיל ב־high, לעלות ל־xhigh רק עבור עבודה שהיכולת בה רגישה במיוחד, ולרדת ל־medium או ל־low עבור עבודה שגרתית, משום שב־Fable 5 מאמץ נמוך יותר מנצח לעיתים קרובות את xhigh במודלים קודמים. יש לכך שתי מלכודות. שינוי המאמץ בין בקשות מבטל את ה־prompt cache, משום שערך המאמץ שנקבע נכלל ב־prompt. לכן בחרו רמה אחת לכל סוג עומס ושמרו עליה קבועה. בנוסף, max_tokens הוא מגבלה קשיחה על כלל ה־output, כלומר על ה־thinking ועל טקסט התשובה יחד, ולכן מגבלה שנקבעה לתשובה ללא thinking תגרום לקטיעה. הופעת stop_reason: "max_tokens" פירושה שעליכם להגדיל את המגבלה או להקטין את המאמץ.

עלות לכל משימה שהושלמה, לא עלות לכל טוקן

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

השורות 3 הן חישוב חשבוני, לא תוצאה של benchmark. התעריפים מפורסמים. נפחי הטוקנים הם הנחות, ועליכם להחליף אותם בנתונים מהשימוש שלכם. סשן קידוד במבנה של השורה האמצעית עולה $5.00 עם Fable 5, לעומת $1.00 עם Sonnet 5. הריצה הארוכה עולה $40.00 לעומת $8.00. העמודה של Haiku בשורה האחרונה היא חישוב חשבוני בלבד: ל־Haiku 4.5 יש חלון הקשר של 200k טוקנים, ולכן הוא אינו יכול להכיל את המשימה הזו כלל.

עלות לכל טוקן היא יחידת המדידה הלא נכונה לקבלת החלטה. עלות לכל משימה שהושלמה היא העלות לכל ניסיון, כפול מספר הניסיונות. בתעריפים של היום, ניסיון אחד עם Fable 5 עולה כמו חמישה ניסיונות עם Sonnet 5, ולכן מספר הניסיונות החוזרים לבדו כמעט אף פעם אינו מצדיק שדרוג. Sonnet יצטרך להיכשל ביותר מארבעה מתוך חמישה ניסיונות לפני שהמסלול הזול יפסיד מבחינת צריכת הטוקנים.

מה שמצדיק את השדרוג הוא כל מה שחשבון הטוקנים אינו כולל. הפער בין שתי הריצות הארוכות בתרשים קטן מעלות של שעת עבודה אחת של מהנדס ברוב השווקים. אם המודל היקר חוסך שעת בדיקה, או מונע migration שגוי אחד שאחר כך צריך לפרק ולתקן, הוא כבר החזיר את עלותו — בחשבון שלא מציג את החיסכון הזה. בצעו את ההשוואה לפי עלות כספית לכל תוצאה שאושרה, וכללו את הזמן שלכם בסכום הכולל. הבנה של התמורה בפועל ממיליון טוקנים הופכת את ההערכה הזו להרבה פחות מופשטת.

שלוש משימות שבהן Claude Fable 5 מצדיק את המחיר

הרצות של סוכנים לאורך זמן, שבהן טעות יקרה לתיקון. Fable 5 מיועד לעבודה הנמדדת בשעות: חלון הקשר של 1M tokens, עד 128k output tokens לכל בקשה, ורמת xhigh effort המיועדת למשימות שנמשכות יותר משלושים דקות, עם תקציבי tokens של מיליונים. השוו את עלות ההרצה לעבודה הנדרשת לניקוי המצב לאחר שסוכן בוחר ענף שגוי בשלב 40, ואיש אינו מבחין בכך עד שלב 300.

העברה או ביקורת שמבצעים פעם אחת על בסיס קוד גדול. בעבודה חד־פעמית אין נפח שמאפשר לפרוס את העלות, ולכן התוספת למחיר לכל token מופיעה בחשבונית אחת, וייתכן שכל המשימה תיכלל בחלון הקשר יחיד. אם אפשר להריץ אותה באופן אסינכרוני, ה־Batch API מצמצם את העלות בחצי, ל־$25 לכל מיליון output tokens.

משימה שמודל זול יותר כבר נכשל בה פעמיים. שני ניסיונות כושלים, בתוספת הזמן שהשקעתם בניפוי באגים, עולים יותר מניסיון יחיד עם Fable בהיקפים המוצגים בתרשים שלמעלה. מעבר למודל חזק יותר הוא הענף הזול יותר, ולשם כך נועדה היררכיית המודלים. אם אתם עדיין בוחרים באופן כללי בין רמות, השוואת היכולות בין רמות המודלים של Claude עונה על שאלה אחרת מזו שעונה עליה דף זה.

שלוש משימות שבהן Sonnet 5 או Haiku 4.5 הן הבחירה הנכונה

סיווג וחילוץ בנפח גבוה. משימות אלה נמדדות לפי קצב העיבוד והעלות ליחידה, ותקרת האיכות שלהן נמוכה מספיק כדי שמודל זול יגיע אליה. כאשר משימה ש־Haiku 4.5 משלים כראוי עולה פי 10, Fable 5 אינו מספק ערך מדיד נוסף.

עבודה אינטראקטיבית שבה זמן האחזור הוא חלק מהמוצר. טבלת המודלים של Anthropic מציינת שזמן האחזור היחסי של Fable 5 איטי יותר, ואי אפשר להשבית את החשיבה. תיבת צ'אט או השלמה בעורך מרגישות פחות טובות במודל החזק יותר, משום שהמשתמשים מבחינים בהמתנה לפני שהם מבחינים באיכות.

כל דבר שתלוי באירועים שהתרחשו לאחר January 2026. נקודת החיתוך של הידע האמין של Fable 5 היא January 2026. אצל Opus 5 היא May 2026. המודל היקר יותר מעודכן פחות, ולכן בשאלות על עדכניות אתם משלמים פי 2 עבור ידע ישן יותר, אלא אם תספקו לו כלי חיפוש או שליפה.

אילוץ אחד אינו קשור כלל לעלות. Fable 5 שומר נתונים במשך 30 יום ואינו זמין במסגרת zero data retention, משום שהוא מוגדר כ־Covered Model. אם ההסכם שלכם מחייב zero retention, Fable 5 אינו אפשרי בכל מחיר, והנחה כלשהי לא תשנה זאת.

מה מראים מאגרי fable-method, ומה הם אינם מראים

אנשי מקצוע פרסמו מאגרים שמזקקים את האופן שבו גישות Fable 5 פועלות, לכדי מיומנויות שמודל זול יותר יכול לבצע. מאגר fable-method מתאר מיומנות חשיבה, לולאת תזמור ומאמת יריב, שמריץ מחדש כל בדיקה שנטענה במקום לקרוא את הדוח של הסוכן עצמו. בקובץ ה־README נכתב זאת במפורש: "זהו זיקוק קהילתי, ולא תוצר של Anthropic."

יש להתייחס אליו בדיוק כך. הוא מעיד על האופן שבו אנשים מפעילים את המודל, אך אינו תיעוד של אופן פעולת המודל. שום דבר בו לא קיבל אימות מ־Anthropic, וקיימים כמה forks כמעט זהים עם ניסוחים שונים. זה מאפיין שהייתם מצפים למצוא במסורת שבעל־פה, ולא במפרט.

המסקנה הרלוונטית להחלטת עלות היא שהרכיבים שאנשים מצאו ראויים להעתקה הם פרוצדורליים. סווגו את המשימה, הגדירו את הבדיקה שמוכיחה שהיא הושלמה, אספו ראיות לפני קבלת החלטה, ולאחר מכן אמתו את התוצאה באמצעות תצפית ולא באמצעות קריאת סיכום. מודל זול יותר שקיבל checklist מפורש ושלב אימות יכול לצמצם חלק מהפער. לכן הריצו את הניסוי הזה על ערכת ההערכה שלכם לפני שתקבעו להשתמש במודל היקר. התוצאה תלויה במשימות שלכם, ולכן למספר של מישהו אחר אין עבורכם ערך רב.

בדקו את המספרים שלכם לפני שאתם מתחייבים לתקציב

  • קראו את usage בכל תגובה, ותעדו את output_tokens_details.thinking_tokens בנפרד מהפלט הגלוי. ההיסק שאינכם רואים הוא סעיף העלות שמפתיע משתמשים.
  • הגדירו את effort במפורש במקום לקבל את ערך ברירת המחדל, ושמרו עליו קבוע בתוך כל שיחה שמסתמכת על שמירת prompts במטמון.
  • הציבו תחילה את הקידומת היציבה שלכם מאחורי נקודת שמירה במטמון. קריאה מהמ​​טמון בעלות של עשירית ממחיר קלט בסיסי חוסכת יותר מרוב המעברים למודלים זולים יותר.
  • העבירו ל־Batch API כל משימה שאינה דורשת תשובה מיידית.
  • תמחרו את החלופה בכנות. השוואת התמחור של Claude ושל ChatGPT API לפי עומס העבודה שלכם מצדיקה אחר צהריים של בדיקה לפני התחייבות ממושכת.

אם עומס העבודה הוא agent שפועל בשרת שלכם, הבקרות החשובות ביותר נמצאות מחוץ לבחירת המודל. שמירה על עלויות agent בשליטה ב־VPS מכסה את מגבלות הלולאה ואת תקרות ההוצאה שעוצרות סשן שיצא משליטה, ו־היכן Claude Code באמת צורך tokens מסביר את המספרים שתראו בלוח הבקרה של השימוש.

FAQ

כמה עולה Claude Fable 5 לכל מיליון טוקנים?

Claude Fable 5 עולה $10 לכל מיליון טוקני קלט ו־$50 לכל מיליון טוקני פלט ב־Claude API, לפי בדיקה בדף התמחור של Anthropic ב־3 באוגוסט 2026. קריאת מטמון עולה $1 לכל מיליון טוקנים, כלומר עשירית מתעריף הקלט הבסיסי. ה־Batch API מעניק הנחה של 50% בשני הצדדים, ולכן המחירים לעבודה אסינכרונית הם $5 ו־$25 לכל מיליון טוקנים. שמירה על ביצוע ההיסק בתוך ארצות הברית באמצעות הפרמטר inference_geo מוסיפה מכפיל של 1.1 לכל קטגוריית תמחור.

האם Claude Fable 5 כלול במינוי Claude Pro?

בדף Claude Fable של Anthropic מצוין שהמודל זמין למשתמשי Pro, Max, Team ו־Enterprise, ולא מצוין בו המסלול החינמי. הגישה הכלולה אינה בלתי מוגבלת. בחלק מהמושבים Fable נכלל כחלק ממגבלות השימוש השבועיות, ובאחרים הגישה מתבצעת באמצעות קרדיטי שימוש. הסדר הזה השתנה יותר מפעם אחת במהלך יולי 2026. קראו את השורה Fable בטבלת השוואת המסלולים בדף התמחור של Anthropic ביום קבלת ההחלטה, במקום להסתמך על נתון ממאמר. לאחר שמכסת השימוש הכלולה נוצלה, שימוש נוסף מחויב לפי תעריף ה־API.

מדוע החשבון שלי עבור Claude Fable 5 גבוה יותר מכפי שנראה לפי הפלט הגלוי?

חשיבה אדפטיבית פעילה תמיד ב־Claude Fable 5. טוקני החשיבה מחויבים כטוקני פלט, ותהליך החשיבה הגולמי לעולם אינו מוחזר. כאשר thinking.display מוגדר לערך ברירת המחדל omitted, מופיע שדה חשיבה ריק, אך החיוב כולל כל טוקן המשמש להיסק שמאחוריו. קראו את usage.output_tokens_details.thinking_tokens בתגובה כדי לראות את הפירוט. בעת הזרמת נתונים, השדה מגיע רק באירוע message_delta האחרון. הורידו את רמת effort אם היחס בין ההיסק לתשובה גבוה יותר ממה שנדרש למשימה.

האם כדאי להשתמש ב־Claude Fable 5 או ב־Claude Opus 5?

Claude Opus 5 עולה חצי מחיר לכל טוקן, ויש לו מועד חיתוך ידע אמין ועדכני יותר: מאי 2026, לעומת ינואר 2026 עבור Fable 5. התחילו ב־Opus 5 והסלימו ל־Fable 5 כאשר המשימה נכשלת בו, או כאשר העלות של תשובה שגויה גבוהה מהפרש המחירים. Fable 5 מתאים למשימות סוכן ארוכות־טווח, שבהן ענף שגוי אחד עלול לדרוש שעות של ניקוי ותיקון, וכן למשימות חד־פעמיות שבהן התוספת משולמת בחשבון יחיד במקום בכל בקשה לאורך זמן.

#claude#fable#model-selection#pricing#tokens