← Назад в блог

15 августа 2026 г.12 мин • AI Architecture Team

Модели Claude 5: Opus 5, Sonnet 5, Haiku 4.5 и Fable 5 — сравнение, цены и когда что брать

Полное сравнение актуальных моделей Claude: идентификаторы, окно контекста, цены за токены, сильные стороны каждой модели и практические рекомендации, какую выбирать под задачу.

Что такое поколение Claude 5

Claude 5 — актуальное поколение моделей Anthropic. Внутри поколения модели различаются не датой выхода, а позиционированием: сколько интеллекта вы получаете за единицу стоимости и как быстро приходит ответ.

Ключевое отличие поколения от предыдущих — окно контекста в 1 миллион токенов у старших моделей. На практике это означает, что в один запрос помещается крупный репозиторий, объёмная документация или несколько сотен страниц текста без ручной нарезки на куски.

Ещё одно важное изменение: управление глубиной рассуждения теперь идёт через параметр усилия, а не через фиксированный бюджет токенов на размышление. Старый параметр budget_tokens на моделях Claude 5 отклоняется — это частая ошибка при переносе кода со старых версий.

Таблица: цены и характеристики

Цены указаны в долларах за миллион токенов по официальному прайсу Anthropic: сначала входящие токены (то, что вы отправляете), затем исходящие (то, что генерирует модель). Исходящие всегда дороже примерно в пять раз — это стоит держать в голове при проектировании промптов.

МодельИдентификаторКонтекстВход $/1MВыход $/1M
Claude Fable 5claude-fable-51M1050
Claude Opus 5claude-opus-51M525
Claude Opus 4.8claude-opus-4-81M525
Claude Sonnet 5claude-sonnet-51M210
Claude Haiku 4.5claude-haiku-4-5200K15

Когда какая модель оправдана

Claude Opus 5 — модель по умолчанию для серьёзной работы: архитектурные решения, разбор незнакомой кодовой базы, длинные агентные цепочки, сложная отладка. Если задача требует держать в голове много связей одновременно, Opus окупается сокращением числа итераций.

Claude Sonnet 5 — оптимальный выбор для повседневной разработки. Он в два с половиной раза дешевле Opus на входе и в два с половиной раза на выходе, при этом уверенно справляется с типовыми продуктовыми задачами: генерация кода по описанию, рефакторинг, работа с текстом, поддержка чат-интерфейсов.

Claude Haiku 4.5 — для объёма. Классификация тикетов, извлечение полей из документов, модерация, простые ответы в поддержке. Там, где важна не глубина, а стоимость одного из ста тысяч запросов.

Claude Fable 5 — самая мощная широко доступная модель, для задач, где цена ошибки выше цены токенов: тяжёлые исследования, длинные автономные прогоны, предельно сложное рассуждение. У неё есть особенности API: мышление всегда включено, а параметры сэмплирования недоступны.

  • Архитектура, сложный анализ, агенты — Opus 5.
  • Повседневная разработка и продуктовые фичи — Sonnet 5.
  • Массовые дешёвые операции — Haiku 4.5.
  • Предельно сложные и длинные задачи — Fable 5.

Сколько это в реальных деньгах

Абстрактные доллары за миллион токенов плохо переводятся в интуицию. Пара ориентиров: обычный диалоговый запрос с ответом на пару абзацев — это порядка тысячи входящих и пятисот исходящих токенов. На Sonnet 5 такой запрос стоит доли цента, и десять тысяч таких запросов укладываются в несколько десятков долларов.

Совсем другая картина с агентными сценариями. Одна плотная сессия Claude Code по крупному проекту легко съедает миллионы токенов: агент читает файлы, держит историю, вызывает инструменты. Здесь выбор между Opus и Sonnet напрямую определяет счёт в конце месяца, а грамотное кеширование контекста экономит до 90% на повторяющейся части запроса.

  • Короткий диалог: тысячи токенов, копейки.
  • Разбор документа на 100 страниц: сотни тысяч входящих токенов.
  • Сессия агента по репозиторию: миллионы токенов за час работы.
  • Кеширование повторяющегося контекста снижает стоимость входа примерно на порядок.

Как выбрать модель в коде

Модель указывается строкой идентификатора в каждом запросе — менять ключ или адрес подключения для этого не нужно. Идентификаторы полные и самодостаточные: никаких дат в конце дописывать не надо, это устаревшая привычка со старых поколений.

Через наш шлюз работают те же самые идентификаторы, что и в официальной документации. Переключение между моделями — это одна строка в коде, поэтому разумная стратегия такая: начните с Sonnet 5, замерьте качество на своих реальных примерах и поднимайтесь до Opus 5 только там, где Sonnet ошибается.

  • Начните с более дешёвой модели и повышайте только по результатам замера.
  • Не смешивайте модели внутри одной цепочки без необходимости — это ломает кеш.
  • Для подзадач внутри агента ставьте модель попроще и низкое усилие.

Доступ к моделям Claude 5 из России

Все перечисленные модели доступны через наш шлюз по стандартным идентификаторам Anthropic. Тариф покупается в рублях, лимит расходуется по фактическому потреблению токенов, а в личном кабинете видно, какая модель сколько съела — это удобно для оптимизации: часто выясняется, что 80% расхода даёт один сценарий, который спокойно переносится на Sonnet или Haiku.

Что дальше

Если планируете внедрять Claude API в продакшн, начните с понятной структуры тарифа и сразу настройте контроль расхода токенов в личном кабинете.