SSD Nodes Learn Hosting plans →
Посібники Matt ConnorВід Matt Connor · Оновлено 2026-09-06

Claude Fable 5: ціна та коли її використовувати

Claude Fable 5 коштує $10 за мільйон вхідних і $50 за мільйон вихідних токенів. Дізнайтеся, як ці тарифи впливають на реальні завдання.

Скільки коштує Claude Fable 5?

Claude Fable 5 коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів у Claude API. Це опубліковані Anthropic тарифи, отримані зі сторінки з цінами 3 August 2026. Ідентифікатор моделі API — claude-fable-5. Модель стала загальнодоступною 9 June 2026 у Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud і Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Ціни можна розглядати як шкалу. Fable 5 коштує вдвічі дорожче за Claude Opus 5, у п’ять разів дорожче за поточний тариф Claude Sonnet 5 і в десять разів дорожче за Claude Haiku 4.5. Співвідношення однакове для вхідних і вихідних токенів, оскільки кожна модель у цій таблиці має тариф на вихідні токени, що рівно у п’ять разів перевищує її тариф на вхідні токени. Тому, якщо відомий розподіл вхідних і вихідних токенів для завдання, один тариф можна перерахувати в інший множенням.

Одна дата змінює розрахунок. До 31 August 2026 для Sonnet 5 діють вступні тарифи $2 і $10 за мільйон токенів. З 1 September 2026 тариф становитиме $3 і $15. Власна ціна Fable 5 не змінюється, тому цього дня різниця між двома моделями скоротиться з п’яти разів до трохи більше ніж трьох. Якщо ви складаєте бюджет на осінь, використовуйте пізніші тарифи Sonnet.

Знижки та єдиний множник, який збільшує вартість

Кешування prompt є найефективнішим способом зменшити витрати. Читання з кешу коштує одну десяту базової ціни вхідних токенів — $1 за мільйон токенів у Fable 5. Запис до кешу коштує дорожче, ніж звичайний вхідний токен: 1.25 базової ціни для кешу на п’ять хвилин і 2 базові ціни для кешу на одну годину. Кеш на п’ять хвилин окупається після одного читання, а кеш на одну годину — після двох читань. Цього розрахунку достатньо, щоб визначити, коли кешування prompt виходить у нуль перед його повсюдним увімкненням.

Batch API зменшує обидві складові вартості на 50%, тому пакетна обробка в Fable 5 коштує $5 за вхідні токени та $25 за вихідні токени на мільйон токенів. Batch-запити виконуються асинхронно, тому це підходить лише для завдань, результат яких не потрібен негайно. Дві знижки сумуються, тому пакетне завдання з кешуванням є дешевим за обома складовими.

Контекстне вікно на 1M токенів входить до стандартних тарифів Claude 4.6 і новіших моделей. Доплати за довгий контекст немає, тому запит на 900k токенів тарифікується за тією самою ціною за токен, що й запит на 9k токенів.

Множник, який збільшує рахунок, пов’язаний із розміщенням даних. Якщо встановити inference_geo: "us", щоб виконувати інференс у межах Сполучених Штатів, до кожної категорії токенів застосовується множник 1.1, зокрема до читання та запису в кеш. Залишайте глобальну маршрутизацію за замовчуванням, якщо інше не передбачено договором.

Для цієї моделі діє окреме правило тарифікації. До складу Fable 5 входять safety classifiers, які можуть відхилити запит. У такому разі Messages API повертає stop_reason: "refusal" як успішну відповідь HTTP 200, а не помилку, і плата не стягується за запит, відхилений до генерування будь-якого результату. Якщо повторити той самий prompt в іншій моделі Claude, fallback credit компенсує вартість кешу prompt під час перемикання, тому вам не доведеться двічі прогрівати той самий кеш.

Які плани включають Claude Fable 5?

Станом на 3 серпня 2026 року на сторінці Claude Fable від Anthropic зазначено, що модель доступна користувачам Pro, Max, Team і Enterprise. Безкоштовний план не згадується. Pro — найдешевший варіант у цьому списку, тому вартість Pro і межі його використання визначає мінімальну ціну будь-якого способу отримати підписку на Fable. Якщо основною причиною переходу на платний план буде доступ до Fable, спочатку розгляньте чи варто самостійно платити за план Pro з огляду на ваше використання, оскільки обмежений доступ до Fable сам по собі недостатньо виправдовує підписку. Для розробників модель загалом доступна через Claude API і перелічені вище cloud marketplaces. У цьому варіанті немає безкоштовного рівня, тому невеликий кредит, який Anthropic надає під час реєстрації, — це весь безкоштовний обсяг до початку тарифікації.

Доступність у плані не означає необмежене використання. Підписка також тарифікується не так, як API, оскільки для місця Pro взагалі не опубліковано квоту токенів, а використання натомість враховується в повідомленнях за рухомим часовим вікном. Тому жоден показник плану не можна коректно перерахувати у наведені вище значення на мільйон токенів. У таблиці порівняння планів на сторінці тарифів Anthropic доступ до Fable для деяких місць обмежений часткою тижневих лімітів використання, а для інших — кредитами використання. Протягом липня 2026 року ця схема змінювалася кілька разів. У власному повідомленні Anthropic про повторне розгортання Fable 5 зазначалося, що до 7 липня 2026 року модель доступна в межах до 50% тижневих лімітів використання для планів Pro, Max, Team і вибраних планів Enterprise, а після цієї дати застосовуються кредити використання. У повідомленнях за решту липня описувалися подальші продовження цього періоду та різниця між типами місць.

Тому на цій сторінці не наведено ліміт для кожного плану. Жодне значення, опубліковане протягом того місяця, не залишалося актуальним навіть два тижні, а застаріле число було б гіршим, ніж його відсутність. У день ухвалення рішення відкрийте рядок Fable у таблиці порівняння планів і вважайте будь-яке число в новинній статті застарілим. Якщо ви придбаєте місце заради доступу до Fable, а фактичний ліміт виявиться меншим, ніж можна було очікувати з таблиці, перехід на дешевший план до наступного продовження збереже вже оплачений місяць без змін.

Стабільною є ставка API. У будь-якому варіанті після використання включеного ліміту подальше використання Fable 5 тарифікується за цінами на наведеній вище діаграмі. Для Enterprise ця структура описана явно, оскільки плата за місце Enterprise надає доступ, а самі токени додатково тарифікуються за ставками API. Тому саме прайс-лист є основним показником для планування витрат у будь-якому випадку. Такий самий висновок випливає з порівняння тарифікації API з підпискою для будь-якої іншої моделі Claude. Якщо ви ще не вибрали рівень, почніть із матеріалу який план Claude відповідає вашому використанню. Якщо це місце також буде вашим щоденним помічником, а не лише способом отримати доступ до Fable, перед оформленням підписки варто перевірити як ціни планів Claude порівнюються з ChatGPT.

Чому рахунок вищий, ніж випливає з цінового співвідношення

Є два задокументовані механізми, через які Fable 5 коштує дорожче, ніж випливає з прямого порівняння цін.

Перший — токенізатор. У Fable 5 використовується токенізатор, представлений разом із Claude Opus 4.7. Порівняно з моделями, випущеними до Opus 4.7, той самий текст дає приблизно на 30% більше токенів, а точне збільшення залежить від вмісту. Haiku 4.5 використовує попередню версію токенізатора, тому десятикратна різниця в прайс-листі після подачі однакового тексту до обох моделей фактично наближається до тринадцятикратної. У Sonnet 5 використовується новіший токенізатор, тому порівняння Fable із Sonnet за кількістю токенів є коректним. Порівняння Fable з Haiku — ні.

Другий механізм — reasoning. Adaptive thinking у Fable 5 завжди увімкнено, а thinking: {"type": "disabled"} не підтримується. Токени reasoning тарифікуються як вихідні токени за повною ставкою для вихідних даних. Сировий ланцюжок міркувань у цій моделі ніколи не повертається, а thinking.display за замовчуванням має значення "omitted". Тому коротка видима відповідь може мати велику кількість тарифікованих вихідних токенів. У документації Anthropic це сформульовано прямо: кількість тарифікованих вихідних токенів не збігається з кількістю видимих токенів у відповіді.

Переглядайте деталізацію, а не робіть припущення. Поле usage.output_tokens_details.thinking_tokens показує, скільки тарифікованих вихідних токенів було використано для reasoning:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

У цьому прикладі з документації Anthropic щодо thinking 312 із 348 тарифікованих вихідних токенів припадають на reasoning, якого ніхто не бачив. Під час потокової передачі ця деталізація надходить лише в останній події message_delta. Тому клієнт, який припиняє читання після останнього текстового фрагмента, ніколи її не збереже.

Керує цим параметр effort, встановлений у output_config.effort, із рівнями low, medium, high (значення за замовчуванням), xhigh і max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Для цієї моделі Anthropic рекомендує починати зі значення high, переходити до xhigh лише для роботи, чутливої до можливостей моделі, і знижувати значення до medium або low для стандартних завдань. Причина в тому, що для Fable 5 нижчий рівень зусиль часто дає кращий результат, ніж xhigh у попередніх моделях. Тут є дві типові пастки. Зміна рівня зусиль між запитами робить кеш prompt недійсним, оскільки resolved effort value вбудовується в prompt. Тому виберіть один рівень для кожного типу навантаження та не змінюйте його. Крім того, max_tokens є жорстким обмеженням для всіх вихідних даних: воно враховує reasoning і текст відповіді разом. Обмеження, розраховане для відповіді без reasoning, призведе до обрізання відповіді. Якщо ви бачите stop_reason: "max_tokens", збільште обмеження або зменште рівень зусиль.

Вартість виконаного завдання, а не вартість токена

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Ці 3 рядки містять арифметичні розрахунки, а не результати тестування. Тарифи опубліковані. Обсяги токенів є припущеннями, які потрібно замінити даними з вашого власного використання. Сеанс розробки, подібний до наведеного в середньому рядку, коштує $5.00 у Fable 5 проти $1.00 у Sonnet 5. Тривалий запуск коштує $40.00 проти $8.00. Значення в стовпці Haiku в останньому рядку є лише результатом арифметичного розрахунку: Haiku 4.5 має контекстне вікно на 200k токенів, тому взагалі не може вмістити це завдання.

Вартість токена — неправильна одиниця для ухвалення рішення. Вартість виконаного завдання дорівнює вартості однієї спроби, помноженій на кількість спроб. За сьогоднішніми тарифами одна спроба у Fable 5 коштує стільки само, як п’ять спроб у Sonnet 5, тому сама кількість повторних спроб майже ніколи не виправдовує перехід на дорожчу модель. Sonnet має завершуватися невдало більш ніж у чотирьох із п’яти випадків, перш ніж дешевший варіант стане дорожчим за обсягом токенів.

Підставою для такого переходу є все, чого немає в рахунку за токени. У більшості ринків різниця між двома тривалими запусками на графіку менша за вартість однієї години роботи інженера. Якщо дорожча модель заощаджує годину перевірки або допомагає уникнути невдалої міграції, яку потім доведеться виправляти, вона вже окупила себе, хоча в рахунку ця економія не відображається. Порівнюйте витрати в розрахунку на прийнятий результат і враховуйте власний час у загальній сумі. Розуміння того, що насправді можна отримати за мільйон токенів зробить цю оцінку значно конкретнішою.

Три завдання, для яких Claude Fable 5 виправдовує свою ціну

Тривалі агентні запуски, де помилка дорого коштує. Fable 5 призначено для роботи, яку вимірюють годинами: контекстне вікно на 1M токенів, до 128k вихідних токенів на запит і рівень зусиль xhigh для завдань, що виконуються понад тридцять хвилин і потребують мільйонних бюджетів токенів. Порівняйте вартість запуску з очищенням результатів після того, як агент на кроці 40 обрав неправильну гілку, а помилку помітили лише на кроці 300.

Міграція або аудит, які ви одноразово виконуєте у великій кодовій базі. Одноразову роботу немає з чим масштабувати, тому вища ціна за токен припадає на один рахунок, а все завдання може поміститися в одне контекстне вікно. Якщо запуск можна виконувати асинхронно, Batch API зменшує цю ціну вдвічі — до $25 за мільйон вихідних токенів.

Завдання, з яким дешевша модель уже двічі не впоралася. Дві невдалі спроби разом із часом на налагодження коштують дорожче, ніж одна спроба Fable за обсягів, наведених у графіку вище. Перехід на потужнішу модель є дешевшим варіантом — саме для цього й потрібна ієрархія моделей. Якщо ви ще загалом обираєте між рівнями, порівняння можливостей рівнів моделей Claude відповідає на інше запитання, ніж ця сторінка.

Три завдання, для яких Sonnet 5 або Haiku 4.5 є правильним вибором

Класифікація та вилучення даних у великих обсягах. Для таких завдань важливі пропускна здатність і вартість одиниці операції, а гранична якість достатньо низька, щоб її забезпечила недорога модель. Якщо завдання Haiku 4.5 виконує правильно, то десятикратна ціна Fable 5 не дає вимірюваної переваги.

Інтерактивна робота, де затримка є ключовим фактором. У таблиці моделей Anthropic зазначено, що порівняльна затримка Fable 5 вища, а режим міркування неможливо вимкнути. Чат або автодоповнення в редакторі працює гірше на потужнішій моделі, оскільки користувачі помічають очікування раніше, ніж вищу якість.

Будь-які завдання, що залежать від подій після January 2026. Надійна дата актуальності знань Fable 5 — January 2026. Для Opus 5 це May 2026. Дорожча модель має менш актуальні знання, тому за запити про нові події ви вдвічі переплачуєте за старішу інформацію, якщо не надасте їй інструменти пошуку або отримання даних.

Є обмеження, не пов’язане з вартістю. Для Fable 5 передбачено зберігання даних протягом 30 днів, і модель недоступна в режимі zero data retention, оскільки її визначено як Covered Model. Якщо ваша угода вимагає zero retention, Fable 5 не можна використовувати за жодної ціни, і жодна знижка цього не змінить.

Що показують репозиторії fable-method і чого вони не показують

Практики опублікували репозиторії, у яких узагальнено підходи Fable 5 у вигляді skills, що їх може виконувати дешевша модель. Репозиторій fable-method описує навичку міркування, orchestration loop і adversarial verifier, який повторно виконує кожну заявлену перевірку, а не покладається на власний звіт агента. У його README прямо зазначено: «Це спільнотна адаптація, а не артефакт Anthropic».

Сприймайте це саме так. Репозиторій показує, як люди керують моделлю, але не документує принцип її роботи. Anthropic не перевіряла жоден із наведених у ньому підходів. Крім того, існує кілька майже ідентичних fork із різними формулюваннями. Це більше схоже на фольклор, ніж на специфікацію.

Для оцінювання вартості важливий такий висновок: скопіювати намагалися саме процедурні частини. Класифікуйте завдання, називайте перевірку, яка підтверджує його завершення, збирайте докази до ухвалення рішення, а потім перевіряйте результат спостереженням, а не читанням підсумку. Якщо передати дешевшій моделі явний checklist і крок верифікації, можна скоротити частину розриву в якості. Тому спочатку проведіть такий експеримент на власному evaluation set, а вже потім стандартизуйте використання дорожчої моделі. Результат залежить від ваших завдань, тому чужі показники мало для вас варті.

Перевірте власні розрахунки, перш ніж затверджувати бюджет

  • Перевіряйте usage у кожній відповіді та записуйте output_tokens_details.thinking_tokens окремо від видимого результату. Рядок витрат, якого ви не бачите, найчастіше стає несподіваною статтею бюджету.
  • Явно задавайте effort замість використання значення за замовчуванням і не змінюйте його в межах розмови, яка використовує prompt caching.
  • Спочатку розмістіть стабільний префікс за cache breakpoint. Читання з кешу за однією десятою базової ціни вхідних даних заощаджує більше, ніж зазвичай дає перехід на дешевшу модель.
  • Перенесіть до Batch API все, що не потребує негайної відповіді.
  • Реалістично оцініть альтернативу. Порівняння цін на Claude і ChatGPT API для власного робочого навантаження варте одного дня роботи перед довгостроковим рішенням.

Якщо робоче навантаження виконує агент на вашому власному сервері, найважливіші засоби контролю не залежать від вибору моделі. У матеріалі Як контролювати витрати агента на VPS описано обмеження циклів і ліміти витрат, які зупиняють неконтрольований сеанс, а матеріал де Claude Code фактично витрачає токени пояснює показники, які ви побачите на інформаційній панелі використання.

FAQ

Скільки коштує Claude Fable 5 за мільйон токенів?

На Claude API ціна Claude Fable 5 становить $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів. Ціни перевірено на сторінці тарифів Anthropic 3 August 2026. Читання з кешу коштує $1 за мільйон токенів, тобто одну десяту базової ставки для вхідних токенів. Batch API зменшує обидві ставки на 50%: для асинхронних операцій ціна становить $5 і $25 за мільйон токенів відповідно. Виконання інференсу лише у Сполучених Штатах із параметром inference_geo додає множник 1.1 до кожної категорії.

Чи входить Claude Fable 5 до підписки Claude Pro?

На сторінці Claude Fable від Anthropic модель зазначена як доступна для користувачів Pro, Max, Team та Enterprise. Безкоштовний план на цій сторінці не згадується. Доступ у межах підписки не є необмеженим. Для одних користувачів Fable доступний у межах частини тижневого ліміту, а для інших — за рахунок кредитів на використання. Протягом July 2026 ці умови змінювалися більше одного разу. У день ухвалення рішення прочитайте рядок Fable у таблиці порівняння планів на сторінці тарифів Anthropic. Не покладайтеся на цифру зі статті. Після вичерпання включеного ліміту подальше використання оплачується за тарифом API.

Чому мій рахунок за Claude Fable 5 вищий, ніж можна припустити за видимим результатом?

Adaptive thinking завжди увімкнено для Claude Fable 5. Токени міркувань оплачуються як вихідні токени, а необроблений ланцюжок міркувань ніколи не повертається. За стандартного значення omitted параметра thinking.display ви бачите порожнє поле міркувань, але оплачуєте всі токени міркувань, які генеруються за ним. Перегляньте usage.output_tokens_details.thinking_tokens у відповіді, щоб побачити розподіл. Під час потокової передачі це поле надходить лише в останній події message_delta. Зменште рівень effort, якщо співвідношення міркувань і відповіді вище, ніж потрібно для завдання.

Що вибрати: Claude Fable 5 чи Claude Opus 5?

Claude Opus 5 коштує вдвічі менше за токен і має новішу надійну дату актуальності знань: May 2026 проти January 2026 у Fable 5. Почніть з Opus 5 і переходьте на іншу модель, якщо завдання не виконується в ньому або якщо неправильна відповідь коштує дорожче за різницю в ціні. Fable 5 варто вибрати для агентних завдань із довгим горизонтом, коли одна помилкова гілка може призвести до багатогодинного виправлення, а також для разових завдань, коли додаткова плата потрапляє в один рахунок, а не нараховується за кожен запит безстроково.

#claude#fable#model-selection#pricing#tokens