← Назад в блог

23 сентября 2026 г.10 мин • AI Architecture Team

Claude Opus 5.5: обзор нового Opus — дешевле Opus 5, кеш за 0,20 доллара и что изменилось в API

Обзор Claude Opus 5.5: идентификатор claude-opus-5-5, контекст 1M токенов, 128K на выход, цена 4 и 20 долларов за миллион, чтение кеша 0,20. Всегда включённое мышление, effort medium по умолчанию и четыре ломающих изменения.

Что такое Opus 5.5 и где его место в линейке

Claude Opus 5.5 — следующая модель линейки Opus и прямой преемник Opus 5. Идентификатор claude-opus-5-5, контекст 1 миллион токенов (это и максимум, и значение по умолчанию), до 128 тысяч токенов на выход, граница знаний — июнь 2026 года. Anthropic позиционирует её под длинную агентную разработку и сложную работу со знаниями — ту же нишу, что занимал Opus 5.

Необычное в этом релизе то, что новая модель дешевле предыдущей: 4 доллара за миллион входящих токенов и 20 за миллион исходящих против 5 и 25 у Opus 5. Токенизатор тот же, поэтому одинаковый запрос занимает на обеих моделях одинаковое число токенов, и разница в цене переходит в счёт напрямую.

Место в линейке не меняется. Сверху остаётся Fable 5.1 — самая мощная широко доступная модель Anthropic за 10 и 50 долларов. Ниже — Sonnet 5 для повседневной разработки и Haiku 4.5 для массовых простых операций. Opus 5 никуда не исчезает и продолжает работать по своему прайсу.

ПараметрOpus 5.5Opus 5
Идентификаторclaude-opus-5-5claude-opus-5
Вход $/1M45
Выход $/1M2025
Запись кеша на 5 минут $/1M56,25
Запись кеша на 1 час $/1M810
Чтение кеша $/1M0,200,50
Контекст / максимум на выход1M / 128K1M / 128K
Усилие по умолчаниюmediumhigh
Отключение мышленияНет, ошибка 400Да, на усилии до high
tool_choice any / toolНет, ошибка 400Да
Fast mode $/1M8 / 4010 / 50

Цена: минус 20% на токенах и минус 60% на чтении кеша

На входе и выходе экономия ровно 20%. На записи кеша — тоже 20%: 5 долларов вместо 6,25 за пятиминутный кеш и 8 вместо 10 за часовой. А вот чтение кеша подешевело сильнее всего — с 0,50 до 0,20 доллара за миллион, то есть в 2,5 раза.

Для агентных сценариев это главная строка прайса. Основная масса входящих токенов в длинной сессии — это повторно отправляемый стабильный префикс: системный промпт, описания инструментов, история. Он обслуживается из кеша, и именно здесь Opus 5.5 выигрывает больше всего.

Оговорка: цена за токен — не цена за задачу. У Opus 5.5 мышление нельзя выключить, а уровень усилия по умолчанию другой, поэтому число исходящих токенов на ту же задачу может отличаться от Opus 5 в обе стороны. Как это посчитать на своих маршрутах, мы разобрали в отдельной статье про стоимость Opus 5.5.

  • Вход и выход — 4 / 20 долларов за миллион вместо 5 / 25.
  • Чтение кеша — 0,20 вместо 0,50 доллара за миллион.
  • Токенизатор тот же — счётчик токенов не меняется.

Мышление: всегда включено, по умолчанию — medium

На Opus 5 мышление включено по умолчанию, но его можно отключить на уровне усилия high и ниже. На Opus 5.5 оно включено всегда: значение disabled в параметре thinking и фиксированный бюджет budget_tokens возвращают 400 на любом уровне усилия. Параметр thinking либо не передают, либо передают со значением adaptive — это одно и то же.

Единственный рычаг глубины рассуждения — уровень усилия в output_config: low, medium, high, xhigh или max. И здесь ловушка при переезде: по умолчанию у Opus 5.5 стоит medium, на ступень ниже, чем high у Opus 5. Код, который не задаёт усилие явно, после смены идентификатора начнёт думать меньше. Поэтому усилие стоит прописать явно на каждом маршруте.

Если на Opus 5 у вас был маршрут с выключенным мышлением ради скорости, на Opus 5.5 его заменяет низкий уровень усилия. На low модель рассуждает коротко, а насколько часто пропускает рассуждение совсем — зависит от промптов. Учитывайте, что рассуждение считается в max_tokens: лимит, подобранный под ответ без мышления, может обрезать ответ.

  • thinking disabled и budget_tokens — ошибка 400.
  • Усилие по умолчанию — medium, а не high: задавайте явно.
  • Вместо отключения мышления — effort low.
  • Закладывайте рассуждение в max_tokens.

Что ещё изменилось в API

Принудительный вызов инструмента убран, как на Fable 5.1: tool_choice со значениями any и tool возвращает 400 — в том числе в пакетном режиме и при подсчёте токенов. Замена — auto плюс строгая схема инструмента и явная инструкция в промпте, а если принудительный вызов нужен был только ради JSON — структурированный вывод.

Блоки мышления привязаны к модели и к диалогу. Opus 5.5 читает блоки, созданные Opus 5 и более ранними моделями, но его собственные блоки на Claude API читают только Fable 5.1 и Mythos 5.1. При откате на Opus 5 рассуждение предыдущих ходов просто отбрасывается. А редактирование прошлых ходов для аккаунтов, созданных с 31 августа 2026 года, приводит к ошибке 400: история должна дописываться, а не переписываться.

Управление компьютером работает только через набор инструментов computer_toolset_20260801, старый инструмент computer_20251124 возвращает 400. И короткие заметки о прогрессе между вызовами инструментов теперь приходят не текстовыми блоками, а блоками мышления — по умолчанию пустыми. Интерфейс, который показывает только текст, во время длинного агентного хода будет молчать.

Каждое изменение и способ его починить мы разобрали в статье про переезд с Opus 5 на Opus 5.5.

  • tool_choice any и tool — ошибка 400.
  • Блоки мышления привязаны к модели и диалогу.
  • Управление компьютером — только через computer toolset.
  • Заметки о прогрессе — в блоках мышления.

Что осталось как у Opus 5

Всё остальное переносится без изменений: системные сообщения посреди диалога и смена усилия по ходу диалога, бюджеты задач, серверное сжатие контекста, пакетная обработка, Files API, работа с PDF и изображениями, серверные и клиентские инструменты. Минимальный размер кешируемого префикса — те же 512 токенов.

Префилл ответа ассистента по-прежнему не принимается, параметры сэмплирования temperature, top_p и top_k — тоже. Существующие промпты под Opus 5, по данным Anthropic, должны работать хорошо без переписывания.

Расширился набор защитных классификаторов: к категории cyber добавились bio и reasoning_extraction. Отказ приходит обычным ответом с кодом 200 и причиной остановки refusal — проверяйте её до чтения содержимого. Промпт, который требует воспроизвести внутреннее рассуждение в тексте ответа, теперь может быть отклонён именно по reasoning_extraction.

Кому переезжать, а кому подождать

Переезжать в первую очередь стоит тем, у кого на Opus 5 крутятся длинные агентные сессии с хорошим кешированием: там снижение цены чтения кеша даёт максимальный эффект, а мышление и так было включено.

Подождать и померить стоит тем, у кого на Opus 5 есть маршруты с выключенным мышлением, особенно короткие и массовые. На них исходящих токенов может стать больше, и 20% скидки на токен это не перекроют. Такие маршруты нужно прогнать на уровне усилия low и сравнить стоимость за запрос.

Отдельно — интеграции с принудительным вызовом инструментов и с управлением компьютером через старый инструмент. Для них смена идентификатора без правок кода означает ошибки 400 с первого запроса.

  • Длинные агентные сессии с кешем — переезжать.
  • Маршруты без мышления — сначала замерить на effort low.
  • Принудительный tool_choice и computer use — сначала править код.

Как вызвать Opus 5.5 из России

Через наш шлюз модель вызывается тем же ключом, что и остальные: достаточно указать claude-opus-5-5 в поле model. Базовый URL, токен и SDK остаются прежними, VPN не требуется.

Расход по Opus 5.5 тарифицируется по собственной строке — с новой ценой входа, выхода и чтения кеша — и виден в личном кабинете отдельно от Opus 5. Удобно запустить новую модель на части трафика и сравнить стоимость маршрутов на реальных запросах.

  • Идентификатор в запросе: claude-opus-5-5.
  • Ключ, базовый URL и SDK — без изменений.
  • Расход виден в кабинете отдельной строкой.

Что дальше

Если планируете внедрять Claude API в продакшн, начните с понятной структуры тарифа и сразу настройте контроль расхода токенов в личном кабинете.