SSD Nodes Learn 🎉 VPS від $5.50/міс
Посібники Matt ConnorВід Matt Connor · Оновлено 2026-08-13

Claude Fable 5: ціна та коли її використовувати

Claude Fable 5 коштує $10 за мільйон вхідних і $50 за мільйон вихідних токенів. Дізнайтеся, як ці тарифи змінюють вибір моделі для ваших задач.

Скільки коштує Claude Fable 5?

Claude Fable 5 коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів у Claude API. Це опубліковані тарифи Anthropic, отримані зі сторінки з цінами 3 серпня 2026 року. Ідентифікатор моделі API — claude-fable-5. Модель стала загальнодоступною 9 червня 2026 року в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud і Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Розглядайте це як шкалу. Ціна Fable 5 у два рази вища за Claude Opus 5, у п’ять разів вища за поточний тариф Claude Sonnet 5 і в десять разів вища за Claude Haiku 4.5. Співвідношення однакове для обох складових рахунку, оскільки кожна модель у цій таблиці має тариф за вихідні токени, рівний рівно п’ятикратному тарифу за вхідні токени. Тому, якщо ви знаєте співвідношення вхідних і вихідних токенів для завдання, один тариф можна перерахувати в будь-який інший множенням.

Одна дата змінює розрахунок. До 31 серпня 2026 року для Sonnet 5 діють вступні тарифи $2 і $10 за мільйон токенів. З 1 вересня 2026 року тариф становитиме $3 і $15. Власна ціна Fable 5 не змінюється, тому цього дня різниця між ними зменшиться з п’ятикратної до трохи більшої за трикратну. Якщо ви складаєте бюджет на осінь, використовуйте пізніші тарифи Sonnet.

Знижки та єдиний множник, який працює у зворотному напрямку

Кешування промптів дає найбільший ефект. Читання з кешу коштує одну десяту базової ціни вхідних токенів — $1 за мільйон токенів у Fable 5. Запис у кеш коштує дорожче за звичайний вхідний токен: 1.25 базової ціни для кешу на п’ять хвилин і 2 базові ціни для кешу на одну годину. Кеш на п’ять хвилин окупається після одного читання, а кеш на одну годину — після двох читань. Цієї арифметики достатньо, щоб визначити, коли кешування промптів окупається, перш ніж увімкнути його всюди.

Batch API зменшує ціну на 50% для обох категорій, тому пакетні запити Fable 5 коштують $5 і $25 за мільйон токенів. Пакетні запити виконуються асинхронно, тому це підходить лише для завдань, відповідь на які не потрібна негайно. Дві знижки сумуються, тому кешоване пакетне завдання має низьку вартість за обома категоріями.

Контекстне вікно на 1M токенів у Claude 4.6 і новіших моделях включено до стандартних тарифів. Доплати за довгий контекст немає, тому запит на 900k токенів тарифікується за тією самою ціною за токен, що й запит на 9k токенів.

Множник, який збільшує рахунок, пов’язаний із розміщенням даних. Якщо встановити inference_geo: "us", щоб виконувати інференс у межах Сполучених Штатів, до кожної категорії токенів застосовується множник 1.1, включно з читанням і записом у кеш. Залишайте глобальну маршрутизацію за замовчуванням, якщо інше не передбачено договором.

Для цієї моделі діє окреме правило тарифікації. Fable 5 постачається із класифікаторами безпеки, які можуть відхилити запит. У такому разі Messages API повертає stop_reason: "refusal" як успішну відповідь HTTP 200, а не помилку, і плата за запит, відхилений до генерування будь-якого виводу, не стягується. Якщо повторити той самий промпт в іншій моделі Claude, fallback credit компенсує вартість кешу промпту через перемикання, тому вам не доведеться двічі прогрівати той самий кеш.

Які плани включають Claude Fable 5?

Станом на 3 серпня 2026 року на сторінці Anthropic про Claude Fable зазначено, що модель доступна користувачам планів Pro, Max, Team і Enterprise. Безкоштовний план не згадується. Pro — найдешевший варіант у цьому списку, тому вартість Pro і межі його лімітів використання визначають мінімальну вартість будь-якої підписки для доступу до Fable. Для розробників модель загальнодоступна через Claude API і перелічені вище хмарні маркетплейси. У цьому варіанті немає безкоштовного рівня, тому невеликий кредит, який Anthropic надає під час реєстрації, — це все, що ви отримуєте до початку тарифікації.

Доступність у плані не означає необмежене використання. У таблиці порівняння планів на сторінці цін Anthropic доступ до Fable для одних планів обмежений часткою тижневого ліміту використання, а для інших — кредитами на використання. Протягом липня 2026 року ця схема змінювалася кілька разів. У власному повідомленні Anthropic про повторне розгортання Fable 5 зазначено, що до 7 липня 2026 року модель можна було використовувати в межах до 50% тижневих лімітів використання в планах Pro, Max, Team і деяких планах Enterprise, а після цієї дати застосовувалися кредити на використання. У повідомленнях, опублікованих до кінця липня, йшлося про подальше продовження цього періоду та різні умови для різних типів місць.

Тому на цій сторінці не наведено ліміт для кожного плану. Жодне значення, опубліковане протягом того місяця, не залишалося чинним навіть два тижні, а застаріле число було б гіршим за його відсутність. У день, коли ви ухвалюєте рішення, відкрийте рядок Fable у таблиці порівняння планів і вважайте будь-яке число в новинній статті застарілим. Якщо ви придбали місце заради доступу до Fable, а дозволений обсяг виявився меншим, ніж випливало з таблиці, перехід на нижчий план до наступного поновлення збереже вже оплачений місяць без змін.

Стабільною залишається тарифікація API. У будь-якому варіанті після використання включеного обсягу подальше використання Fable 5 оплачується за цінами з наведеної вище таблиці. У Enterprise ця структура описана явно, оскільки плата за місце Enterprise забезпечує доступ, але самі токени й далі тарифікуються за ставками API додатково до неї. Отже, у будь-якому разі планувати витрати потрібно за прайс-листом. Такий самий висновок випливає з порівняння тарифікації API з підпискою для будь-якої іншої моделі Claude. Якщо ви ще не вибрали рівень, почніть із матеріалу який план Claude відповідає вашому використанню. Якщо це місце також буде вашим щоденним помічником, а не лише способом отримати доступ до Fable, перед вибором варто перевірити як порівнюються ціни планів Claude і ChatGPT.

Чому рахунок вищий, ніж випливає зі співвідношення цін

Два задокументовані механізми роблять Fable 5 дорожчим, ніж можна припустити за прямим порівнянням цін.

Перший механізм — токенізатор. Fable 5 використовує токенізатор, представлений у Claude Opus 4.7. Порівняно з моделями, випущеними до Opus 4.7, той самий текст дає приблизно на 30% більше токенів, а точне збільшення залежить від вмісту. Haiku 4.5 використовує попередній токенізатор, тому десятикратна різниця в прайс-листі після подавання обом моделям однакового блоку тексту фактично наближається до тринадцятикратної. Sonnet 5 використовує новіший токенізатор, тому порівняння Fable із Sonnet за кількістю токенів є коректним. Порівняння Fable із Haiku — ні.

Другий механізм — міркування. Адаптивне міркування у Fable 5 завжди ввімкнене, а thinking: {"type": "disabled"} не підтримується. Токени міркування тарифікуються як вихідні токени за повною ставкою для вихідних даних. Необроблений ланцюжок міркувань ця модель ніколи не повертає, а thinking.display за замовчуванням дорівнює "omitted". Це означає, що коротка видима відповідь може мати велику кількість тарифікованих вихідних токенів. У документації Anthropic це сформульовано прямо: кількість тарифікованих вихідних токенів не відповідає кількості видимих токенів у відповіді.

Переглядайте деталізацію, а не робіть припущення. Поле usage.output_tokens_details.thinking_tokens показує, скільки тарифікованих вихідних токенів було використано для міркування:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

У цьому прикладі з документації Anthropic про міркування 312 із 348 тарифікованих вихідних токенів припадають на міркування, якого ніхто не бачив. Під час потокової передачі ця деталізація надходить лише в останній події message_delta, тому клієнт, який припиняє читання після останнього фрагмента тексту, ніколи її не збереже.

Параметр керування — effort. Його задають на рівні output_config.effort із такими значеннями: low, medium, high (за замовчуванням), xhigh і max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Anthropic рекомендує для цієї моделі починати з high, переходити до xhigh лише для роботи, критичної до рівня можливостей моделі, а для стандартних завдань знижувати значення до medium або low. Причина в тому, що нижчий рівень зусиль у Fable 5 часто дає кращий результат, ніж xhigh у попередніх моделях. Тут є дві особливості. Зміна рівня зусиль між запитами робить кеш промпту недійсним, оскільки фактичне значення рівня зусиль додається до промпту. Тому виберіть рівень для кожного типу робочого навантаження та не змінюйте його. Крім того, max_tokens є жорстким обмеженням для всіх вихідних даних разом: міркувань і тексту відповіді. Якщо розмір обмеження розраховано на відповідь без міркувань, відповідь буде обрізано. stop_reason: "max_tokens" означає, що потрібно або збільшити обмеження, або зменшити рівень зусиль.

Вартість виконаного завдання, а не вартість токена

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Ці 3 рядки містять арифметичні розрахунки, а не результати бенчмарку. Тарифи опубліковані. Обсяги токенів є припущеннями, які слід замінити даними з вашого власного використання. Сесія кодування, за обсягом подібна до середнього рядка, коштує $5.00 у Fable 5 проти $1.00 у Sonnet 5. Довгий запуск коштує $40.00 проти $8.00. Значення в стовпці Haiku в останньому рядку є лише арифметичним розрахунком: Haiku 4.5 має контекстне вікно на 200k токенів, тому взагалі не може вмістити це завдання.

Вартість токена — неправильна одиниця для ухвалення рішення. Вартість виконаного завдання дорівнює вартості однієї спроби, помноженій на кількість спроб. За поточними тарифами одна спроба у Fable 5 коштує стільки само, як п’ять спроб у Sonnet 5, тому сама лише кількість повторних спроб майже ніколи не виправдовує перехід на дорожчу модель. Sonnet мав би завершуватися помилкою більш ніж у чотирьох із п’яти спроб, перш ніж дешевший варіант стане дорожчим за токенами.

Перехід виправдовують інші витрати, які не відображаються в рахунку за токени. Різниця між двома довгими запусками на графіку в більшості ринків менша за вартість однієї години роботи інженера. Якщо дорожча модель заощаджує годину перевірки або запобігає невдалій міграції, наслідки якої потім довелося б виправляти, вона вже окупила себе, хоча в рахунку ця економія не відображається. Порівнюйте вартість одного прийнятого результату в грошах і враховуйте власний час у загальній сумі. Розуміння того, що насправді дає мільйон токенів зробить цю оцінку значно конкретнішою.

Три завдання, для яких Claude Fable 5 виправдовує свою ціну

Тривалі агентські запуски, у яких помилка має високу ціну. Fable 5 призначено для роботи, що вимірюється годинами: контекстне вікно на 1M токенів, до 128k вихідних токенів на запит і рівень зусиль xhigh, розрахований на завдання тривалістю понад тридцять хвилин із бюджетами в мільйони токенів. Порівняйте вартість запуску з очищенням після того, як агент обере неправильну гілку на кроці 40, а ніхто не помітить цього до кроку 300.

Міграція або аудит, які ви одноразово виконуєте у великій кодовій базі. Для одноразової роботи немає обсягу, на якому можна було б розподілити витрати, тому підвищена ціна за токен припадає на один рахунок, а все завдання може вміститися в одному контекстному вікні. Якщо завдання можна виконувати асинхронно, Batch API зменшує вартість удвічі — до $25 за мільйон вихідних токенів.

Завдання, на якому дешевша модель уже двічі зазнала невдачі. Дві невдалі спроби разом із часом на налагодження коштують дорожче, ніж одна спроба Fable за обсягів, наведених у таблиці вище. Підвищення рівня моделі є дешевшим варіантом — саме для цього призначена ієрархія моделей. Якщо ви все ще загалом обираєте між рівнями, порівняння можливостей рівнів моделей Claude відповідає на інше запитання, ніж ця сторінка.

Три завдання, де Sonnet 5 або Haiku 4.5 є обґрунтованим вибором

Високопотокова класифікація та вилучення даних. Такі завдання оцінюють за пропускною здатністю та вартістю одиниці обробки, а верхня межа якості достатньо низька, щоб її забезпечувала недорога модель. Якщо Haiku 4.5 правильно виконує завдання, Fable 5 за ціною, що в 10 разів вища, не дає вимірюваної користі.

Інтерактивна робота, де затримка є частиною продукту. У таблиці моделей Anthropic порівняльну затримку Fable 5 вказано як вищу, а режим міркування неможливо вимкнути. Чат або автодоповнення в редакторі працює гірше на потужнішій моделі, оскільки користувачі помічають очікування раніше, ніж різницю в якості.

Усе, що залежить від подій після January 2026. Надійна дата завершення набору знань Fable 5 — January 2026. Для Opus 5 це May 2026. Дорожча модель містить менш актуальні дані, тому за запити про нові події ви платите вдвічі більше за застарілі знання, якщо не надасте їй інструменти пошуку або отримання даних.

Є обмеження, не пов’язане з вартістю. Fable 5 зберігає дані протягом 30 днів і недоступна в режимі zero data retention, оскільки її визначено як Covered Model. Якщо ваша угода вимагає zero retention, Fable 5 не можна використовувати за жодною ціною, і жодна знижка цього не змінить.

Що показують репозиторії методу fable і чого вони не показують

Практики публікують репозиторії, у яких узагальнено підходи Fable 5 у вигляді навичок, яких може дотримуватися дешевша модель. Репозиторій методу fable описує навичку міркування, цикл оркестрації та змагального верифікатора, який повторно виконує кожну заявлену перевірку, а не читає власний звіт агента. У його README це прямо зазначено: "Це узагальнення від спільноти, а не артефакт Anthropic."

Сприймайте його саме так. Це свідчення того, як люди керують моделлю, а не документація про принцип її роботи. Anthropic не підтвердила жодного положення цього репозиторію. Крім того, існує кілька майже ідентичних форків із різними формулюваннями. Це радше характерно для фольклору, ніж для специфікації.

Для рішення щодо вартості важливо те, що люди вважали за потрібне копіювати саме процедурні частини. Класифікуйте завдання, визначте перевірку, яка підтверджує його завершення, зберіть докази перед ухваленням рішення, а потім перевірте результат спостереженням, а не читанням резюме. Якщо передати дешевшій моделі явний контрольний список і додати етап перевірки, частину розриву можна скоротити. Тому спочатку проведіть такий експеримент на власному наборі оцінювання, а вже потім стандартизуйте використання дорожчої моделі. Результат залежить від ваших завдань, тому чужі показники мало для вас важать.

Перевірте власні розрахунки, перш ніж затверджувати бюджет

  • Переглядайте usage у кожній відповіді та записуйте output_tokens_details.thinking_tokens окремо від видимого результату. Невидимі міркування — це стаття витрат, яка зазвичай стає несподіванкою.
  • Явно задавайте effort замість використання значення за замовчуванням і не змінюйте його протягом розмови, яка використовує prompt caching.
  • Спочатку розмістіть стабільний префікс за cache breakpoint. Читання з кешу за однією десятою базової ціни вхідних даних заощаджує більше, ніж перехід на більшість дешевших моделей.
  • Перенесіть до Batch API все, що не потребує негайної відповіді.
  • Чесно оцініть альтернативу. Порівняння цін на API Claude і ChatGPT на власному робочому навантаженні варте одного дня роботи перед довгостроковим рішенням.

Якщо робоче навантаження — це агент, що працює на вашому сервері, найважливіші засоби контролю не залежать від вибору моделі. У матеріалі Як контролювати витрати агента на VPS описано обмеження циклів і ліміти витрат, які зупиняють неконтрольований сеанс, а де Claude Code насправді витрачає токени пояснює показники, які ви побачите на інформаційній панелі використання.

FAQ

Скільки коштує Claude Fable 5 за мільйон токенів?

У Claude API ціна Claude Fable 5 становить $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів. Ціни перевірено на сторінці тарифів Anthropic 3 August 2026. Читання з кешу коштує $1 за мільйон токенів, тобто одну десяту базової ціни вхідних токенів. Batch API зменшує ціну для обох напрямків на 50%, тому асинхронна обробка коштує $5 і $25 за мільйон токенів відповідно. Виконання inference у межах United States із параметром inference_geo додає множник 1.1 до кожної категорії.

Чи входить Claude Fable 5 до підписки Claude Pro?

На сторінці Claude Fable від Anthropic указано, що модель доступна користувачам Pro, Max, Team і Enterprise. Безкоштовний план там не зазначено. Доступ у межах підписки не є необмеженим. Для деяких планів Fable доступний як частина тижневих лімітів використання, а для інших — за рахунок usage credits. Протягом July 2026 ці умови змінювалися більше одного разу. У день ухвалення рішення прочитайте рядок Fable у таблиці порівняння планів на сторінці тарифів Anthropic. Не покладайтеся на цифри зі статті. Після вичерпання включеного ліміту подальше використання оплачується за тарифом API.

Чому мій рахунок за Claude Fable 5 вищий, ніж можна припустити за видимим результатом?

Для Claude Fable 5 adaptive thinking завжди увімкнено. Thinking tokens оплачуються як вихідні токени, а необроблений ланцюжок міркувань ніколи не повертається. За стандартного значення omitted параметра thinking.display поле thinking порожнє, але кожен токен міркувань за ним оплачується. Перегляньте usage.output_tokens_details.thinking_tokens у відповіді, щоб побачити розподіл. Під час потокової передачі воно надходить лише в останній події message_delta. Зменште рівень effort, якщо співвідношення міркувань до відповіді вище, ніж потрібно для завдання.

Що краще використовувати: Claude Fable 5 чи Claude Opus 5?

Claude Opus 5 удвічі дешевший за токен і має новішу надійну межу актуальності знань: May 2026 проти January 2026 для Fable 5. Почніть з Opus 5 і переходьте на Fable 5, якщо завдання не виконується в Opus 5 або якщо неправильна відповідь коштує дорожче за різницю в ціні. Fable 5 варто обрати для агентних завдань із довгим горизонтом, де одна неправильна гілка може вимагати годин очищення результатів, а також для разових завдань, у яких вища ціна припадає на один рахунок, а не на кожен запит у довгостроковій перспективі.

#claude#fable#model-selection#pricing#tokens