SSD Nodes Learn Hosting plans →
Руководства Matt ConnorАвтор: Matt Connor · Обновлено 2026-09-06

Стоимость Claude Fable 5 и расчеты для API

Узнайте актуальные тарифы Claude Fable 5: 10 долларов за миллион входных и 50 долларов за миллион выходных токенов. Разбираем реальную стоимость использования модели в задачах.

Сколько стоит Claude Fable 5?

Стоимость Claude Fable 5 составляет $10 за миллион входных токенов и $50 за миллион выходных токенов при использовании Claude API. Это официальные тарифы Anthropic, опубликованные на странице цен 3 августа 2026 года. Идентификатор модели для API — claude-fable-5. Модель стала общедоступной 9 июня 2026 года в Claude API, Amazon Bedrock, Claude Platform на AWS, Google Cloud и Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Рассматривайте это как иерархию. Стоимость Fable 5 в два раза выше, чем у Claude Opus 5, в пять раз выше текущего тарифа Claude Sonnet 5 и в десять раз выше Claude Haiku 4.5. Соотношение одинаково для обеих сторон счета, так как для каждой модели в этой таблице цена вывода ровно в пять раз превышает цену ввода. Поэтому, если вы знаете распределение входных и выходных токенов для задачи, одна цена конвертируется в другую путем умножения.

Одна дата меняет расчеты. На Sonnet 5 действуют вводные цены $2 и $10 за миллион токенов до 31 августа 2026 года. С 1 сентября 2026 года тариф составит $3 и $15. Цена на Fable 5 не меняется, поэтому разрыв между ними в этот день сократится с пятикратного до чуть более чем трехкратного. Если вы планируете бюджет на осень, используйте более поздние показатели для Sonnet.

Скидки и единственный множитель, увеличивающий стоимость

Кэширование промптов — самый эффективный рычаг экономии. Чтение из кэша стоит одну десятую от базовой цены входных данных, что составляет $1 за миллион токенов в Fable 5. Запись в кэш стоит дороже обычного входного токена: в 1.25 раза больше базовой цены для пятиминутного кэша и в 2 раза — для часового. Пятиминутный кэш окупается после первого же чтения, а часовой — после двух. Эта арифметика — главный аргумент в пользу того, чтобы рассчитать точку окупаемости кэширования промптов, прежде чем включать его повсеместно.

Batch API снижает стоимость в два раза для обеих сторон, поэтому пакетная обработка в Fable 5 стоит $5 и $25 за миллион токенов. Пакетные запросы выполняются асинхронно, поэтому этот метод подходит только для задач, не требующих мгновенного ответа. Эти две скидки суммируются, что делает кэшированную пакетную задачу дешевой по обоим параметрам.

Контекстное окно в 1M токенов включено в стандартные тарифы для Claude 4.6 и более поздних моделей. Дополнительная плата за длинный контекст отсутствует, поэтому запрос на 900k токенов тарифицируется по той же ставке за токен, что и запрос на 9k.

Множитель, увеличивающий счет — это локализация данных. Установка inference_geo: "us" для выполнения инференса внутри США применяет множитель 1.1 ко всем категориям токенов, включая чтение и запись в кэш. Оставьте глобальную маршрутизацию по умолчанию, если иное не требуется по контракту.

Одно правило биллинга специфично для этой модели. Fable 5 поставляется с классификаторами безопасности, которые могут отклонить запрос. В этом случае Messages API возвращает stop_reason: "refusal" как успешный HTTP 200 ответ, а не ошибку, и плата за запрос, отклоненный до генерации вывода, не взимается. Если вы повторно отправляете тот же промпт другой модели Claude, кредит за откат (fallback credit) компенсирует стоимость кэширования промпта при переключении, поэтому вы не платите дважды за прогрев одного и того же кэша.

Какие тарифные планы включают Claude Fable 5?

По состоянию на 3 августа 2026 года на странице Anthropic, посвященной Claude Fable, указано, что модель доступна пользователям тарифов Pro, Max, Team и Enterprise. Бесплатный тариф не упоминается. Pro — самый доступный вариант из этого списка, поэтому стоимость Pro и ограничения на использование определяют минимальный порог затрат для доступа к Fable по подписке. Если доступ к Fable — основная причина для перехода на платный тариф, сначала оцените целесообразность оплаты Pro-подписки для ваших задач, так как небольшой лимит на использование Fable может не оправдать стоимость подписки. Для разработчиков модель доступна через Claude API и облачные маркетплейсы, перечисленные выше. Бесплатного уровня доступа в этом случае нет, поэтому небольшой стартовый кредит от Anthropic — это всё, что предоставляется до начала тарификации.

Наличие в тарифе не означает неограниченный доступ. Подписка также не тарифицируется по числу запросов так же, как API, поскольку для места Pro вообще не опубликована квота токенов, а использование вместо этого учитывается в сообщениях за скользящий период. Поэтому ни один тариф нельзя напрямую сопоставить с приведёнными выше значениями на миллион.

В таблице сравнения тарифов на странице цен Anthropic доступ к Fable зависит от доли недельных лимитов использования для одних мест и от кредитов на использование для других. В течение июля 2026 этот порядок менялся несколько раз. В собственном сообщении Anthropic о повторном развёртывании Fable 5 указано, что модель доступна в пределах до 50% недельных лимитов использования до 7 июля 2026 на тарифах Pro, Max, Team и некоторых тарифах Enterprise. После этой даты применяются кредиты на использование. В сообщениях, опубликованных до конца июля, описывались дальнейшие продления и разделение условий по типам мест.

Поэтому на этой странице не будут указаны лимиты для каждого плана. Ни одна цифра, опубликованная в течение того месяца, не оставалась актуальной дольше двух недель, а устаревшие данные здесь принесли бы больше вреда, чем пользы. Откройте строку с названием Fable в таблице сравнения тарифов в день принятия решения и считайте любые цифры из новостных статей неактуальными. Если вы приобрели подписку ради доступа к Fable, а лимит оказался меньше, чем следовало из таблицы, отмена подписки до следующего периода продления позволит сохранить доступ до конца уже оплаченного месяца.

Стабильным остается только тариф API. В любом случае, после исчерпания включенного лимита дальнейшее использование Fable 5 оплачивается по ценам, указанным в таблице выше. В тарифе Enterprise эта структура выражена явно, так как стоимость места в Enterprise обеспечивает доступ, но токены всё равно тарифицируются по ценам API сверх этой суммы. Это делает прайс-лист основным ориентиром для планирования в любом случае; к такому же выводу вы придете, сравнивая оплату через API с подпиской для любой другой модели Claude. Если вы еще не выбрали тариф, начните с выбора плана Claude, соответствующего вашим потребностям. Если этот тариф будет использоваться не только для доступа к Fable, но и как повседневный помощник, стоит проверить сравнение цен на планы Claude с ChatGPT перед оформлением подписки.

Почему ваш счет выше, чем предполагает соотношение цен

Два задокументированных механизма приводят к тому, что Fable 5 обходится дороже, чем следует из простого сравнения цен.

Первый — это токенизатор. Fable 5 использует токенизатор, представленный в Claude Opus 4.7. По сравнению с моделями, выпущенными до Opus 4.7, один и тот же текст генерирует примерно на 30% больше токенов, причем точный прирост зависит от содержания. Haiku 4.5 использует более старый токенизатор, поэтому десятикратная разница в прайс-листе превращается почти в тринадцатикратную, если подать обеим моделям один и тот же блок текста. Sonnet 5 использует новый токенизатор, поэтому сравнение Fable и Sonnet по токенам корректно. Сравнение Fable и Haiku — нет.

Второй механизм — это процесс мышления. Адаптивное мышление в Fable 5 включено всегда, а thinking: {"type": "disabled"} не поддерживается. Токены мышления оплачиваются как выходные токены по полному тарифу. Исходная цепочка рассуждений в этой модели не возвращается, а thinking.display по умолчанию имеет значение "omitted", что означает, что короткий видимый ответ может содержать большое количество оплачиваемых выходных токенов. В документации Anthropic это указано прямо: количество оплачиваемых выходных токенов не совпадает с количеством видимых токенов в ответе.

Изучите детализацию вместо догадок. Поле usage.output_tokens_details.thinking_tokens показывает, сколько оплачиваемых выходных токенов было потрачено на рассуждения:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

В этом примере, взятом из документации Anthropic по процессу мышления, 312 из 348 оплачиваемых выходных токенов пришлись на рассуждения, которые никто не видел. При потоковой передаче (streaming) эта детализация приходит только в финальном событии message_delta, поэтому клиент, который прекращает чтение на последнем текстовом фрагменте, никогда не зафиксирует эти данные.

Управление осуществляется через effort, задаваемый параметром output_config.effort, с уровнями low, medium, high (по умолчанию), xhigh и max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Рекомендация Anthropic для этой модели — начинать с high, переходить к xhigh только для задач, критически чувствительных к возможностям модели, и снижать уровень до medium или low для рутинной работы, исходя из того, что меньшие усилия в Fable 5 часто превосходят xhigh в более ранних моделях. С этим связаны две ловушки. Изменение уровня усилий между запросами делает недействительным ваш кэш промптов (prompt cache), так как итоговое значение усилий включается в промпт, поэтому выбирайте уровень для конкретной рабочей нагрузки и придерживайтесь его. Кроме того, max_tokens является жестким ограничением на общий объем вывода, включая мышление и текст ответа, поэтому лимит, рассчитанный на ответ без мышления, приведет к обрезанию текста. Появление stop_reason: "max_tokens" означает, что вам нужно либо увеличить лимит, либо снизить уровень усилий.

Стоимость выполненной задачи, а не стоимость токена

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Эти 3 строк — результат арифметических вычислений, а не эталонный тест. Тарифы являются публичными. Объемы токенов — это допущения, которые вам следует заменить на показатели из ваших собственных данных об использовании. Сеанс программирования, соответствующий средней строке, стоит $5.00 при использовании Fable 5 против $1.00 при использовании Sonnet 5. Длительный запуск стоит $40.00 против $8.00. Столбец Haiku в последней строке — это только арифметика: Haiku 4.5 имеет контекстное окно в 200k токенов, поэтому оно вообще не может выполнить эту задачу.

Стоимость токена — неверная единица измерения для принятия решения. Стоимость выполненной задачи — это стоимость одной попытки, умноженная на количество попыток. По текущим тарифам одна попытка Fable 5 стоит столько же, сколько пять попыток Sonnet 5, поэтому только лишь количество повторных попыток почти никогда не оправдывает переход на более дорогую модель. Sonnet должна была бы терпеть неудачу более четырех раз из пяти, чтобы дешевый вариант проиграл по затратам на токены.

Что действительно оправдывает расходы, так это всё то, что не учитывается в счете за токены. Разница между двумя длительными запусками в таблице меньше, чем стоимость одного часа работы инженера на большинстве рынков. Если более дорогая модель экономит час на проверку или позволяет избежать одной неудачной миграции, которую потом пришлось бы исправлять, она уже окупила себя в счете, где эта экономия не отображается. Проводите сравнение в деньгах за принятый результат и включайте свое собственное время в общую сумму. Понимание того, что на самом деле можно купить за миллион токенов, делает эту оценку гораздо менее абстрактной.

Три задачи, в которых Claude Fable 5 окупает свою стоимость

Длительные агентские процессы, где цена ошибки высока. Fable 5 спроектирована для работы, измеряемой часами: контекстное окно в 1M токенов, до 128k выходных токенов на запрос и уровень усилий xhigh, рассчитанный на задачи продолжительностью более тридцати минут с бюджетом в миллионы токенов. Сопоставьте стоимость запуска с затратами на исправление последствий, если агент выберет неверный путь на шаге 40, а ошибку заметят только на шаге 300.

Миграция или аудит, выполняемые один раз для большой кодовой базы. Разовые задачи не позволяют распределить расходы на большой объем, поэтому наценка за токен отражается в одном счете, а вся работа может поместиться в одно контекстное окно. Если задачу можно выполнить асинхронно, Batch API снижает стоимость вдвое до $25 за миллион выходных токенов.

Задача, с которой более дешевая модель уже дважды не справилась. Две неудачные попытки плюс время на отладку стоят дороже, чем одна попытка Fable при объемах, указанных в таблице выше. Эскалация — это более экономичный путь, именно для этого и существует иерархия моделей. Если вы все еще выбираете между уровнями в общем случае, сравнение возможностей уровней моделей Claude отвечает на другой вопрос, нежели эта страница.

Три задачи, где Sonnet 5 или Haiku 4.5 — оптимальный выбор

Массовая классификация и извлечение данных. Эти задачи оцениваются по пропускной способности и стоимости единицы обработки, а порог качества достаточно низок, чтобы его достигла бюджетная модель. При десятикратной разнице в цене за задачу, которую Haiku 4.5 выполняет корректно, Fable 5 не дает измеримых преимуществ.

Интерактивная работа, где продукт — это низкая задержка. В таблице моделей Anthropic указано, что сравнительная задержка Fable 5 выше, а процесс «мышления» нельзя отключить. Чат-бот или автодополнение в редакторе кажутся менее удобными при использовании более мощной модели, так как пользователи замечают ожидание раньше, чем качество ответа.

Любые задачи, зависящие от событий после января 2026 года. Надежный срез знаний Fable 5 ограничен январем 2026 года. У Opus 5 этот срез — май 2026 года. Более дорогая модель обладает менее актуальными данными, поэтому при вопросах о текущих событиях вы платите двойную цену за устаревшие знания, если только не предоставляете модели инструменты поиска или получения данных.

Одно ограничение не связано со стоимостью. Fable 5 предусматривает хранение данных в течение 30 дней и недоступна в режиме без сохранения данных, так как относится к категории Covered Model. Если ваше соглашение требует отсутствия хранения данных, Fable 5 не может быть использована ни при каких условиях, и никакие скидки этого не изменят.

Что показывают репозитории метода fable и чего они не показывают

Практики опубликовали репозитории, в которых обобщено, как подходы Fable 5 превращаются в навыки, доступные для более дешевых моделей. В репозитории fable-method описаны навык мышления, цикл оркестрации и состязательный верификатор, который повторно выполняет каждую заявленную проверку, а не просто считывает отчет агента. В файле README прямо сказано: «Это результат обобщения сообществом, а не артефакт Anthropic».

Относитесь к этому именно так. Это свидетельство того, как люди управляют моделью, а не документация того, как работает сама модель. Ничто из этого не подтверждено компанией Anthropic, к тому же существует несколько почти идентичных форков с разной формулировкой, что и следовало ожидать от фольклора, а не от спецификации.

Полезный вывод для принятия решения о затратах заключается в том, что части, которые люди сочли нужным скопировать, носят процедурный характер. Классифицируйте задачу, назовите проверку, подтверждающую её выполнение, соберите доказательства перед принятием решения, а затем выполните верификацию путем наблюдения, а не чтения сводки. Более дешевая модель, получив четкий контрольный список и этап верификации, частично сокращает разрыв в качестве, поэтому проведите такой эксперимент на собственном наборе данных для оценки, прежде чем стандартизировать использование дорогой модели. Результат зависит от ваших задач, поэтому чужие показатели не имеют для вас большой ценности.

Проверяйте собственные показатели перед утверждением бюджета

  • Изучайте usage в каждом ответе и регистрируйте output_tokens_details.thinking_tokens отдельно от видимого вывода. Рассуждения, которые вы не видите, — это та статья расходов, которая часто становится неожиданностью.
  • Устанавливайте effort явно, вместо того чтобы полагаться на значения по умолчанию, и сохраняйте это значение неизменным в рамках любого диалога, использующего кэширование промптов.
  • Размещайте стабильный префикс перед точкой разрыва кэша. Чтение из кэша по цене в одну десятую от стоимости базового ввода экономит больше средств, чем переход на менее мощные модели.
  • Переносите любые задачи, не требующие немедленного ответа, в Batch API.
  • Честно оценивайте альтернативы. Сравнение цен на API Claude и ChatGPT для вашей рабочей нагрузки стоит того, чтобы потратить на это полдня перед принятием долгосрочных обязательств.

Если рабочая нагрузка представляет собой агент, работающий на вашем собственном сервере, наиболее важные элементы управления находятся вне выбора модели. Контроль расходов на агентов на VPS описывает лимиты циклов и ограничения по затратам, которые предотвращают бесконечное выполнение сессии, а на что на самом деле расходуются токены в Claude Code объясняет показатели, которые вы увидите на своей панели использования.

FAQ

Сколько стоит Claude Fable 5 за миллион токенов?

Стоимость Claude Fable 5 составляет $10 за миллион входных токенов и $50 за миллион выходных токенов в Claude API согласно странице цен Anthropic на 3 августа 2026 года. Чтение из кэша стоит $1 за миллион токенов, что составляет одну десятую от базовой стоимости входных токенов. Batch API предоставляет скидку 50% на обе операции, что дает $5 и $25 за миллион токенов при асинхронной обработке. Использование параметра inference_geo для ограничения инференса территорией США добавляет множитель 1.1 к каждой категории.

Входит ли Claude Fable 5 в подписку Claude Pro?

На странице Claude Fable компания Anthropic указывает, что модель доступна пользователям тарифов Pro, Max, Team и Enterprise; бесплатный план не упоминается. Доступ в рамках подписки не является безлимитным. Для некоторых пользователей доступ к Fable ограничен долей еженедельных лимитов, для других — кредитными лимитами; эти условия неоднократно менялись в течение июля 2026 года. Проверяйте строку Fable в таблице сравнения планов на странице цен Anthropic в день принятия решения, а не полагайтесь на данные из статей. После исчерпания включенного объема использование оплачивается по тарифам API.

Почему мой счет за Claude Fable 5 выше, чем предполагает объем видимого вывода?

Функция адаптивного мышления (adaptive thinking) в Claude Fable 5 включена всегда; токены процесса мышления оплачиваются как выходные токены, при этом сам процесс рассуждений пользователю не возвращается. При значении thinking.display по умолчанию, равном omitted, вы видите пустое поле для мышления, но оплачиваете каждый токен, затраченный на рассуждения. Проверяйте usage.output_tokens_details.thinking_tokens в ответе, чтобы увидеть распределение, и учитывайте, что при потоковой передаче (streaming) эти данные приходят только в финальном событии message_delta. Снизьте уровень effort, если доля рассуждений в ответе превышает требования вашей задачи.

Что выбрать: Claude Fable 5 или Claude Opus 5?

Claude Opus 5 стоит в два раза меньше за токен и обладает более актуальной базой знаний: май 2026 года против января 2026 года у Fable 5. Начинайте работу с Opus 5 и переходите на Fable 5, если задача не выполняется или если стоимость неверного ответа превышает разницу в цене. Fable 5 — оптимальный выбор для агентских задач с длинным горизонтом планирования, где одна ошибка требует часов на исправление, а также для разовых работ, где переплата ложится на один счет, а не на каждый запрос в будущем.

#claude#fable#model-selection#pricing#tokens