← Назад в блог

19 августа 2026 г.10 мин • AI Architecture Team

Claude Fable 5: обзор самой мощной модели Anthropic и честное сравнение с Opus 5

Что такое Claude Fable 5: цена 10 и 50 долларов за миллион токенов, всегда включённое мышление, недоступный сырой ход рассуждения, требование к сроку хранения данных и другое поведение промптов.

Место Fable 5 в линейке

Claude Fable 5 — самая мощная широко доступная модель Anthropic. Идентификатор claude-fable-5, контекст 1 миллион токенов (и это одновременно значение по умолчанию), до 128 тысяч токенов на выход, цена 10 долларов за миллион входящих и 50 за миллион исходящих.

То есть ровно вдвое дороже Opus 5 по обеим статьям. Позиционирование — предельно сложное рассуждение и длинные автономные прогоны: задачи, где цена ошибки заведомо выше цены токенов.

Отдельно существует Claude Mythos 5 с идентификатором claude-mythos-5 — та же модель по возможностям, цене и поверхности API, но доступная в рамках отдельной программы.

ПараметрFable 5Opus 5
Идентификаторclaude-fable-5claude-opus-5
Вход $/1M105
Выход $/1M5025
Контекст1M1M
МышлениеВсегда включеноПо умолчанию включено, можно отключить
Fast modeНетДа

Мышление отключить нельзя

На Fable 5 рассуждение работает всегда. Параметр thinking либо не передают вовсе, либо передают со значением adaptive — любая другая явная конфигурация отклоняется. Попытка отключить мышление возвращает 400, попытка задать фиксированный бюджет токенов на размышление — тоже 400.

Глубиной управляют уровнем усилия в output_config: доступны все пять значений от low до max. Для рутинных задач имеет смысл прогонять и низкие уровни — на Fable 5 разница между low и max по стоимости заметна сильнее, чем на младших моделях.

  • thinking либо опускают, либо ставят adaptive.
  • Отключение и budget_tokens возвращают 400.
  • Единственный рычаг глубины — effort внутри output_config.

Сырой ход рассуждения недоступен

Ответ содержит обычные блоки мышления, но их содержимое зависит от настройки отображения. Значение summarized возвращает читаемое резюме рассуждения, значение omitted оставляет текст пустым — и omitted стоит по умолчанию.

Это важно для интерфейсов с потоковой отдачей: при умолчании пользователь видит долгую паузу и ничего больше, пока модель думает. Если вы показываете ход рассуждения в UI, отображение нужно запросить явно.

Настройка влияет только на видимость. Рассуждение происходит и тарифицируется одинаково при любом значении, а сырой ход мысли не отдаётся ни на одной модели Claude.

  • По умолчанию блоки мышления приходят пустыми.
  • summarized даёт резюме, но не исходный текст рассуждения.
  • Тарификация от настройки отображения не зависит.

Ограничение, о котором узнают поздно: срок хранения данных

Fable 5 недоступна организациям с нулевым сроком хранения данных. Требуется конфигурация с хранением в течение 30 дней; запрос от организации, чья настройка этому не соответствует, возвращает ошибку 400.

Для компаний, которые выбирают модель под требования внутренней безопасности, это часто оказывается решающим фактором — и выясняется он уже после того, как код написан. Проверять стоит до интеграции, а не после.

  • Нулевое хранение данных и Fable 5 несовместимы.
  • Ошибка приходит на этапе запроса, а не на этапе настройки.
  • Opus 5 такого ограничения не имеет.

Промпты для Fable 5 пишутся иначе

Две особенности поведения, которые ломают ожидания. Первая: один запрос на тяжёлой задаче может выполняться много минут. Это нормальный режим работы, но он требует потоковой отдачи, увеличенных таймаутов и понятного индикатора прогресса в интерфейсе — иначе пользователь решит, что всё зависло.

Вторая: промпты, написанные под предыдущие модели, для Fable 5 часто слишком директивны. Пошаговые предписания, жёсткие инструкции формата и подробные разжёвывания снижают качество ответа, а не повышают. Практика простая — дать полную постановку задачи целиком и убрать микроменеджмент шагов.

Токенизатор у Fable 5 тот же, что у Opus 4.8 и 4.7. Если переезжаете с них, число токенов почти не изменится. Если с Opus 4.6, Sonnet, Haiku или более старых — счётчик стоит перемерить, разница доходит до трети.

  • Длинные ответы — планируйте таймауты и стриминг заранее.
  • Меньше пошаговых предписаний, больше полной постановки задачи.
  • Переезд с моделей до 4.7 требует перезамера токенов.

Отказы и запасная модель

У Fable 5 и Opus 5 есть отдельная причина остановки — отказ по соображениям безопасности. Приходит он с обычным кодом 200, в поле причины остановки стоит refusal, а рядом лежит объект с категорией отказа. Читать содержимое ответа, не проверив причину остановки, — распространённая ошибка.

На такой случай существует серверный механизм запасной модели: при отказе API повторяет тот же запрос на другой модели внутри того же вызова. Отказ до начала генерации не тарифицируется, спасательный прогон считается по расценкам запасной модели.

  • Отказ приходит как успешный HTTP-ответ — проверяйте причину остановки.
  • Запасная модель включается опционально, по умолчанию её нет.
  • Отказ до генерации не оплачивается.

Когда Fable 5 оправдана, а когда нет

Оправдана там, где ошибка стоит дороже удвоенного счёта: длинные автономные исследования, разбор больших противоречивых массивов, задачи с высокой ценой неверного вывода. В таких сценариях один правильный прогон дешевле трёх итераций на модели попроще.

Не оправдана в повседневной разработке. Генерация кода по описанию, рефакторинг, работа с текстом, чат-интерфейсы — всё это Opus 5 и Sonnet 5 делают на уровне, где удвоение цены не окупается. Разумный подход: держать Fable 5 для отдельного маршрута тяжёлых задач, а не ставить её моделью по умолчанию.

  • Тяжёлое исследование и длинные автономные прогоны — Fable 5.
  • Повседневная разработка — Opus 5 или Sonnet 5.
  • Не делайте Fable 5 моделью по умолчанию для всего сервиса.

Что дальше

Если планируете внедрять Claude API в продакшн, начните с понятной структуры тарифа и сразу настройте контроль расхода токенов в личном кабинете.