Claude Fable 5: цена и когда его использовать
Claude Fable 5 стоит $10 за миллион входных и $50 за миллион выходных токенов. Узнайте, как introductory pricing Sonnet 5 меняет расчёт до 1 сентября 2026 года.
Сколько стоит Claude Fable 5?
Claude Fable 5 стоит $10 за миллион входных токенов и $50 за миллион выходных токенов в Claude API. Это опубликованные Anthropic тарифы, взятые со страницы с ценами 3 августа 2026 года. Идентификатор модели API — claude-fable-5. Модель стала общедоступной 9 июня 2026 года в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]Рассматривайте эти цены как шкалу. Цена Fable 5 вдвое выше цены Claude Opus 5, в 5 раз выше текущей цены Claude Sonnet 5 и в 10 раз выше цены Claude Haiku 4.5. Соотношение одинаково для входных и выходных данных, поскольку в этой таблице для каждой модели выходные токены стоят ровно в 5 раз дороже входных. Поэтому, если известна доля входных и выходных токенов в задаче, одну цену можно пересчитать в любую другую умножением.
Одна дата меняет расчёт. До 31 августа 2026 года для Sonnet 5 действует introductory pricing: $2 и $10 за миллион токенов. С 1 сентября 2026 года цена составит $3 и $15. Собственная цена Fable 5 не изменится, поэтому в этот день разница между двумя моделями сократится с 5 раз до немного более чем 3 раз. Если вы составляете бюджет на осень, используйте более поздние цены Sonnet.
Скидки и один множитель, который действует в обратную сторону
Кэширование промптов даёт наибольший эффект. Чтение из кэша стоит одну десятую базовой цены входных данных — $1 за миллион токенов в Fable 5. Запись в кэш стоит дороже обычного входного токена: 1.25 базовой цены для кэша на пять минут и 2 базовые цены для кэша на один час. Кэш на пять минут окупается после одного чтения, а кэш на один час — после двух чтений. Этого достаточно, чтобы сначала рассчитать точку безубыточности кэширования промптов, а уже затем включать его повсеместно.
Batch API снижает стоимость обеих сторон на 50 %, поэтому пакетная обработка в Fable 5 стоит $5 за миллион входных токенов и $25 за миллион выходных токенов. Пакетные запросы выполняются асинхронно, поэтому это подходит только для задач, результат которых не нужен немедленно. Две скидки суммируются, поэтому кэшированная пакетная задача обходится дёшево и по входным, и по выходным токенам.
Контекстное окно на 1M токенов включено в стандартные тарифы для Claude 4.6 и более новых моделей. Дополнительной платы за длинный контекст нет, поэтому запрос на 900k токенов тарифицируется по той же цене за токен, что и запрос на 9k токенов.
Множитель, который увеличивает счёт, связан с размещением данных. Если задать inference_geo: "us", чтобы выполнять инференс только на территории Соединённых Штатов, к каждой категории токенов применяется множитель 1.1, включая чтение и запись в кэш. Оставьте глобальную маршрутизацию по умолчанию, если иное не требуется договором.
Для этой модели действует отдельное правило тарификации. Fable 5 поставляется с классификаторами безопасности, которые могут отклонить запрос. В этом случае Messages API возвращает stop_reason: "refusal" в успешном ответе HTTP 200, а плата за запрос не взимается, если он был отклонён до генерации каких-либо выходных данных. Если повторить тот же промпт на другой модели Claude, механизм fallback credit возмещает стоимость кэширования промпта при переключении, поэтому вам не приходится дважды оплачивать прогрев одного и того же кэша.
Какие планы включают Claude Fable 5?
По состоянию на 3 августа 2026 года на странице Anthropic, посвящённой Claude Fable, указано, что модель доступна пользователям планов Pro, Max, Team и Enterprise. Бесплатный план не упоминается. Для разработчиков модель обычно доступна через Claude API и перечисленные выше облачные marketplaces.
Доступность в рамках плана не означает неограниченное использование без дополнительной оплаты. В таблице сравнения планов на странице цен Anthropic Fable ограничен долей недельного лимита использования для некоторых типов подписок и usage credits для других. В течение июля 2026 года эти условия менялись несколько раз. В заявлении Anthropic о повторном развёртывании Fable 5 указано, что до 7 июля 2026 года модель была доступна в пределах до 50% недельных лимитов использования для планов Pro, Max, Team и некоторых планов Enterprise, а после этой даты применялись usage credits. В публикациях за оставшуюся часть июля описывались дальнейшие продления и различия между типами подписок.
Поэтому на этой странице не приводится лимит для каждого плана. Ни один показатель, опубликованный в течение того месяца, не оставался актуальным дольше двух недель. Устаревшее число здесь было бы хуже полного отсутствия числа. В день принятия решения откройте строку Fable в таблице сравнения планов и считайте любое число в новостной статье устаревшим.
Стабильным остаётся тариф API. Для любого способа доступа после исчерпания включённого лимита дальнейшее использование Fable 5 оплачивается по ценам из приведённой выше таблицы. Поэтому при планировании в любом случае следует ориентироваться на прайс-лист. К такому же выводу вы приходите, сравнивая оплату API с подпиской для любой другой модели Claude. Если вы ещё не выбрали уровень подписки, начните с материала какой план Claude соответствует вашему использованию.
Почему счёт выше, чем предполагает соотношение цен
Два документированных механизма делают Fable 5 дороже, чем следует из простого сравнения цен.
Первый механизм — токенизатор. Fable 5 использует токенизатор, представленный в Claude Opus 4.7. По сравнению с моделями, выпущенными до Opus 4.7, тот же текст даёт примерно на 30% больше токенов. Точный прирост зависит от содержимого. Haiku 4.5 использует прежний токенизатор, поэтому десятикратная разница в прайс-листе при подаче одного и того же блока текста на обе модели становится ближе к тринадцатикратной. Sonnet 5 использует новый токенизатор, поэтому сравнение стоимости одного токена для Fable и Sonnet корректно. Для Fable и Haiku — нет.
Второй механизм — рассуждение. Adaptive thinking всегда включён в Fable 5, а thinking: {"type": "disabled"} не поддерживается. Токены рассуждения тарифицируются как выходные токены по полной ставке для выходных данных. Сырая цепочка рассуждений для этой модели никогда не возвращается, а thinking.display по умолчанию имеет значение "omitted". Поэтому короткий видимый ответ может соответствовать большому числу тарифицируемых выходных токенов. В документации Anthropic это указано прямо: число тарифицируемых выходных токенов не совпадает с числом видимых токенов в ответе.
Вместо предположений изучите разбивку. Поле usage.output_tokens_details.thinking_tokens показывает, сколько тарифицируемых выходных токенов пошло на рассуждение:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}В этом примере из документации Anthropic по thinking 312 из 348 тарифицируемых выходных токенов приходятся на рассуждение, которое никто не увидел. При потоковой передаче эта разбивка поступает только в последнем событии message_delta. Поэтому клиент, который прекращает чтение после последнего фрагмента текста, не сохранит эти данные.
Параметр управления — effort. Он задаётся значением output_config.effort и поддерживает уровни low, medium, high (по умолчанию), xhigh и max.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}Anthropic рекомендует для этой модели начать со значения high, повышать его до xhigh только для задач, где особенно важны возможности модели, а для обычных задач снижать до medium или low. Причина в том, что для Fable 5 меньший уровень усилий часто даёт лучший результат, чем xhigh в более ранних моделях. Здесь есть две особенности. Изменение уровня усилий между запросами делает кэш промпта недействительным, поскольку рассчитанное значение усилий записывается в промпт. Поэтому выберите один уровень для каждого типа нагрузки и не меняйте его. Кроме того, max_tokens — это жёсткий общий лимит для выходных данных, включая рассуждение и текст ответа. Лимит, рассчитанный на ответ без рассуждения, приведёт к усечению ответа. Появление stop_reason: "max_tokens" означает, что нужно увеличить лимит или снизить уровень усилий.
Стоимость выполненной задачи, а не стоимость токена
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]Эти 3 строк содержат арифметические расчёты, а не результаты benchmark. Тарифы опубликованы. Объёмы токенов — это допущения, которые следует заменить данными из вашей статистики использования. Сессия разработки, сопоставимая со средней строкой, стоит $5.00 при использовании Fable 5 и $1.00 при использовании Sonnet 5. Длительный запуск стоит $40.00 против $8.00. Значение в столбце Haiku для последней строки — только арифметический расчёт: контекстное окно Haiku 4.5 вмещает 200k токенов, поэтому эта задача в него не помещается.
Стоимость токена — неправильная единица для принятия решения. Стоимость выполненной задачи равна стоимости одной попытки, умноженной на количество попыток. При текущих тарифах одна попытка Fable 5 стоит столько же, сколько пять попыток Sonnet 5, поэтому одного только количества повторных попыток почти никогда недостаточно для перехода на более дорогую модель. Sonnet должен завершать задачу с ошибкой более чем в четырёх случаях из пяти, чтобы более дешёвый вариант проигрывал по расходу токенов.
Переход на более дорогую модель оправдывают факторы, которые не отражаются в счёте за токены. Разница между двумя длительными запусками на графике в большинстве рынков меньше стоимости одного часа работы инженера. Если более дорогая модель экономит час проверки или предотвращает неудачную миграцию, последствия которой затем приходится устранять, она уже окупается, хотя в счёте эта экономия не отражается. Сравнивайте варианты по стоимости принятого результата и включайте собственное время в общую сумму. Понимание того, что на самом деле можно получить за миллион токенов сделает эту оценку значительно конкретнее.
Три задачи, для которых Claude Fable 5 оправдывает свою стоимость
Длительные агентские запуски, в которых ошибка обходится дорого. Fable 5 рассчитан на задачи продолжительностью в несколько часов: контекстное окно на 1M токенов, до 128k выходных токенов за запрос и уровень усилий xhigh для задач длительностью более тридцати минут с бюджетом в несколько миллионов токенов. Сопоставьте стоимость запуска с затратами на исправление ситуации, когда агент выбирает неверную ветку на шаге 40, а ошибку замечают только на шаге 300.
Миграция или аудит, которые выполняются один раз для большой кодовой базы. Разовые задачи не позволяют распределить затраты на большой объём использования. Поэтому повышенная цена токенов приходится на один счёт, а вся задача может поместиться в одно контекстное окно. Если задачу можно выполнять асинхронно, Batch API снижает стоимость вдвое — до $25 за миллион выходных токенов.
Задача, с которой более дешёвая модель уже дважды не справилась. Стоимость двух неудачных попыток и вашего времени на отладку выше стоимости одной попытки Fable при объёмах, указанных на графике выше. Переход на более мощную модель в этом случае обходится дешевле. Для этого и нужна иерархия моделей. Если вы пока в целом выбираете между уровнями моделей, сравнение возможностей уровней моделей Claude отвечает на другой вопрос, чем эта страница.
Три задачи, где Sonnet 5 или Haiku 4.5 — обоснованный выбор
Высокообъёмная классификация и извлечение данных. Эти задачи оценивают по пропускной способности и стоимости единицы обработки. При этом потолок качества достаточно низкий, чтобы его достигала недорогая модель. Если задача, с которой Haiku 4.5 справляется правильно, стоит в 10 раз дороже, Fable 5 не даёт измеримой выгоды.
Интерактивная работа, где задержка определяет качество продукта. В таблице моделей Anthropic сравнительная задержка Fable 5 указана как более высокая, а режим рассуждений нельзя отключить. Чат или автодополнение в редакторе воспринимаются хуже на более мощной модели, потому что пользователь сначала замечает ожидание и только потом — качество.
Любые задачи, зависящие от событий после January 2026. Надёжная граница знаний Fable 5 — January 2026. У Opus 5 она приходится на May 2026. Более дорогая модель содержит менее актуальные знания. Поэтому за ответы на вопросы о последних событиях вы платите вдвое больше за более старую информацию, если не предоставите модели инструменты поиска или получения данных.
Одно ограничение вообще не связано со стоимостью. Для Fable 5 действует хранение данных в течение 30 дней. Модель недоступна в режиме нулевого хранения данных, поскольку относится к категории Covered Model. Если ваше соглашение требует нулевого хранения, Fable 5 нельзя использовать ни за какую цену, и скидка этого не изменит.
Что показывают репозитории fable-method и чего они не показывают
Практики опубликовали репозитории, в которых обобщены подходы Fable 5 и преобразованы в навыки, которым может следовать более дешёвая модель. В репозитории fable-method описаны навык рассуждения, цикл оркестрации и состязательный верификатор, который повторно выполняет каждую заявленную проверку, а не изучает собственный отчёт агента. В README это сказано прямо: «Это обобщение сообщества, а не материал Anthropic».
Именно так его и следует воспринимать. Репозиторий показывает, как люди управляют моделью, но не документирует принцип её работы. Anthropic не подтверждала приведённые сведения. Кроме того, существует несколько почти идентичных форков с разными формулировками. Это ожидаемо для фольклора, но не для спецификации.
Для решения о затратах важен следующий вывод: процедуры, которые люди сочли полезными для копирования, имеют наибольшую ценность. Классифицируйте задачу, определите проверку, подтверждающую её завершение, соберите данные до принятия решения, а затем проверяйте результат наблюдением, а не чтением сводки. Если передать более дешёвой модели явный контрольный список и этап проверки, часть разрыва можно сократить. Поэтому сначала проведите такой эксперимент на собственном наборе оценки, а уже затем выбирайте дорогую модель в качестве стандартной. Результат зависит от ваших задач, поэтому чужие показатели вряд ли будут для вас полезны.
Проверьте собственные расчёты до утверждения бюджета
- Проверяйте
usageв каждом ответе и отдельно фиксируйтеoutput_tokens_details.thinking_tokens, не отображаемый пользователю. Невидимые рассуждения — это статья расходов, которая чаще всего становится неожиданностью. - Явно задавайте
effortвместо использования значения по умолчанию и не меняйте его в рамках диалога, в котором используется prompt caching. - Сначала разместите стабильный префикс за cache breakpoint. Чтение из cache по цене, составляющей одну десятую от базовой стоимости входных данных, обычно даёт большую экономию, чем переход на большинство более дешёвых моделей.
- Перенесите в Batch API всё, что не требует немедленного ответа.
- Реалистично оцените альтернативу. Перед долгосрочным выбором стоит потратить день на сравнение цен на Claude и ChatGPT API на собственной нагрузке.
Если workload — это агент, работающий на вашем сервере, наиболее важные средства контроля не зависят от выбора модели. В материале как контролировать расходы агента на VPS описаны ограничения циклов и лимиты расходов, которые останавливают неконтролируемую сессию, а материал где Claude Code фактически расходует токены объясняет значения, которые вы увидите на панели использования.
FAQ
Сколько стоит Claude Fable 5 за миллион токенов?
В Claude API цена Claude Fable 5 составляет $10 за миллион входных токенов и $50 за миллион выходных токенов. Эти цены проверены на странице тарифов Anthropic 3 августа 2026 года. Чтение из кэша стоит $1 за миллион токенов, то есть одну десятую базовой цены входных токенов. Batch API снижает цену обеих категорий на 50%: для асинхронных задач она составляет $5 за миллион входных токенов и $25 за миллион выходных токенов. Выполнение inference в пределах США с параметром inference_geo добавляет множитель 1.1 ко всем категориям.
Входит ли Claude Fable 5 в подписку Claude Pro?
На странице Claude Fable компании Anthropic модель указана как доступная пользователям планов Pro, Max, Team и Enterprise. Бесплатный план там не упоминается. Доступ в рамках подписки не является безлимитным. Для некоторых мест Fable доступна в пределах доли недельного лимита использования, а для других — за счёт usage credits. В течение июля 2026 года эта схема менялась несколько раз. В день принятия решения проверьте строку Fable в таблице сравнения планов на странице тарифов Anthropic. Не ориентируйтесь на цифру из статьи. После исчерпания включённого лимита дальнейшее использование оплачивается по тарифу API.
Почему мой счёт за Claude Fable 5 выше, чем предполагает видимый ответ?
В Claude Fable 5 adaptive thinking всегда включено. Токены рассуждений оплачиваются как выходные токены, а исходная chain of thought никогда не возвращается. При значении thinking.display по умолчанию omitted вы видите пустое поле thinking, но оплачиваете каждый токен рассуждений, который был сгенерирован за ним. Прочитайте usage.output_tokens_details.thinking_tokens в ответе, чтобы увидеть распределение. При streaming это поле приходит только в последнем событии message_delta. Уменьшите уровень effort, если доля рассуждений относительно ответа выше, чем требуется задаче.
Следует ли использовать Claude Fable 5 или Claude Opus 5?
Claude Opus 5 вдвое дешевле за токен и имеет более свежую подтверждённую дату отсечения знаний: May 2026 против January 2026 у Fable 5. Начните с Opus 5 и переходите на более дорогую модель, если задача на ней завершается ошибкой или если стоимость неправильного ответа выше разницы в цене. Fable 5 лучше подходит для длительной работы агентов, где одна неверная ветка приводит к часам очистки результатов, а также для разовых задач, когда повышенная цена отражается в одном счёте, а не в каждом запросе на постоянной основе.