Что такое Opus 5.5 и где его место в линейке
Claude Opus 5.5 — следующая модель линейки Opus и прямой преемник Opus 5. Идентификатор claude-opus-5-5, контекст 1 миллион токенов (это и максимум, и значение по умолчанию), до 128 тысяч токенов на выход, граница знаний — июнь 2026 года. Anthropic позиционирует её под длинную агентную разработку и сложную работу со знаниями — ту же нишу, что занимал Opus 5.
Необычное в этом релизе то, что новая модель дешевле предыдущей: 4 доллара за миллион входящих токенов и 20 за миллион исходящих против 5 и 25 у Opus 5. Токенизатор тот же, поэтому одинаковый запрос занимает на обеих моделях одинаковое число токенов, и разница в цене переходит в счёт напрямую.
Место в линейке не меняется. Сверху остаётся Fable 5.1 — самая мощная широко доступная модель Anthropic за 10 и 50 долларов. Ниже — Sonnet 5 для повседневной разработки и Haiku 4.5 для массовых простых операций. Opus 5 никуда не исчезает и продолжает работать по своему прайсу.
| Параметр | Opus 5.5 | Opus 5 |
|---|---|---|
| Идентификатор | claude-opus-5-5 | claude-opus-5 |
| Вход $/1M | 4 | 5 |
| Выход $/1M | 20 | 25 |
| Запись кеша на 5 минут $/1M | 5 | 6,25 |
| Запись кеша на 1 час $/1M | 8 | 10 |
| Чтение кеша $/1M | 0,20 | 0,50 |
| Контекст / максимум на выход | 1M / 128K | 1M / 128K |
| Усилие по умолчанию | medium | high |
| Отключение мышления | Нет, ошибка 400 | Да, на усилии до high |
| tool_choice any / tool | Нет, ошибка 400 | Да |
| Fast mode $/1M | 8 / 40 | 10 / 50 |
Цена: минус 20% на токенах и минус 60% на чтении кеша
На входе и выходе экономия ровно 20%. На записи кеша — тоже 20%: 5 долларов вместо 6,25 за пятиминутный кеш и 8 вместо 10 за часовой. А вот чтение кеша подешевело сильнее всего — с 0,50 до 0,20 доллара за миллион, то есть в 2,5 раза.
Для агентных сценариев это главная строка прайса. Основная масса входящих токенов в длинной сессии — это повторно отправляемый стабильный префикс: системный промпт, описания инструментов, история. Он обслуживается из кеша, и именно здесь Opus 5.5 выигрывает больше всего.
Оговорка: цена за токен — не цена за задачу. У Opus 5.5 мышление нельзя выключить, а уровень усилия по умолчанию другой, поэтому число исходящих токенов на ту же задачу может отличаться от Opus 5 в обе стороны. Как это посчитать на своих маршрутах, мы разобрали в отдельной статье про стоимость Opus 5.5.
- Вход и выход — 4 / 20 долларов за миллион вместо 5 / 25.
- Чтение кеша — 0,20 вместо 0,50 доллара за миллион.
- Токенизатор тот же — счётчик токенов не меняется.
Мышление: всегда включено, по умолчанию — medium
На Opus 5 мышление включено по умолчанию, но его можно отключить на уровне усилия high и ниже. На Opus 5.5 оно включено всегда: значение disabled в параметре thinking и фиксированный бюджет budget_tokens возвращают 400 на любом уровне усилия. Параметр thinking либо не передают, либо передают со значением adaptive — это одно и то же.
Единственный рычаг глубины рассуждения — уровень усилия в output_config: low, medium, high, xhigh или max. И здесь ловушка при переезде: по умолчанию у Opus 5.5 стоит medium, на ступень ниже, чем high у Opus 5. Код, который не задаёт усилие явно, после смены идентификатора начнёт думать меньше. Поэтому усилие стоит прописать явно на каждом маршруте.
Если на Opus 5 у вас был маршрут с выключенным мышлением ради скорости, на Opus 5.5 его заменяет низкий уровень усилия. На low модель рассуждает коротко, а насколько часто пропускает рассуждение совсем — зависит от промптов. Учитывайте, что рассуждение считается в max_tokens: лимит, подобранный под ответ без мышления, может обрезать ответ.
- thinking disabled и budget_tokens — ошибка 400.
- Усилие по умолчанию — medium, а не high: задавайте явно.
- Вместо отключения мышления — effort low.
- Закладывайте рассуждение в max_tokens.
Что ещё изменилось в API
Принудительный вызов инструмента убран, как на Fable 5.1: tool_choice со значениями any и tool возвращает 400 — в том числе в пакетном режиме и при подсчёте токенов. Замена — auto плюс строгая схема инструмента и явная инструкция в промпте, а если принудительный вызов нужен был только ради JSON — структурированный вывод.
Блоки мышления привязаны к модели и к диалогу. Opus 5.5 читает блоки, созданные Opus 5 и более ранними моделями, но его собственные блоки на Claude API читают только Fable 5.1 и Mythos 5.1. При откате на Opus 5 рассуждение предыдущих ходов просто отбрасывается. А редактирование прошлых ходов для аккаунтов, созданных с 31 августа 2026 года, приводит к ошибке 400: история должна дописываться, а не переписываться.
Управление компьютером работает только через набор инструментов computer_toolset_20260801, старый инструмент computer_20251124 возвращает 400. И короткие заметки о прогрессе между вызовами инструментов теперь приходят не текстовыми блоками, а блоками мышления — по умолчанию пустыми. Интерфейс, который показывает только текст, во время длинного агентного хода будет молчать.
Каждое изменение и способ его починить мы разобрали в статье про переезд с Opus 5 на Opus 5.5.
- tool_choice any и tool — ошибка 400.
- Блоки мышления привязаны к модели и диалогу.
- Управление компьютером — только через computer toolset.
- Заметки о прогрессе — в блоках мышления.
Что осталось как у Opus 5
Всё остальное переносится без изменений: системные сообщения посреди диалога и смена усилия по ходу диалога, бюджеты задач, серверное сжатие контекста, пакетная обработка, Files API, работа с PDF и изображениями, серверные и клиентские инструменты. Минимальный размер кешируемого префикса — те же 512 токенов.
Префилл ответа ассистента по-прежнему не принимается, параметры сэмплирования temperature, top_p и top_k — тоже. Существующие промпты под Opus 5, по данным Anthropic, должны работать хорошо без переписывания.
Расширился набор защитных классификаторов: к категории cyber добавились bio и reasoning_extraction. Отказ приходит обычным ответом с кодом 200 и причиной остановки refusal — проверяйте её до чтения содержимого. Промпт, который требует воспроизвести внутреннее рассуждение в тексте ответа, теперь может быть отклонён именно по reasoning_extraction.
Кому переезжать, а кому подождать
Переезжать в первую очередь стоит тем, у кого на Opus 5 крутятся длинные агентные сессии с хорошим кешированием: там снижение цены чтения кеша даёт максимальный эффект, а мышление и так было включено.
Подождать и померить стоит тем, у кого на Opus 5 есть маршруты с выключенным мышлением, особенно короткие и массовые. На них исходящих токенов может стать больше, и 20% скидки на токен это не перекроют. Такие маршруты нужно прогнать на уровне усилия low и сравнить стоимость за запрос.
Отдельно — интеграции с принудительным вызовом инструментов и с управлением компьютером через старый инструмент. Для них смена идентификатора без правок кода означает ошибки 400 с первого запроса.
- Длинные агентные сессии с кешем — переезжать.
- Маршруты без мышления — сначала замерить на effort low.
- Принудительный tool_choice и computer use — сначала править код.
Как вызвать Opus 5.5 из России
Через наш шлюз модель вызывается тем же ключом, что и остальные: достаточно указать claude-opus-5-5 в поле model. Базовый URL, токен и SDK остаются прежними, VPN не требуется.
Расход по Opus 5.5 тарифицируется по собственной строке — с новой ценой входа, выхода и чтения кеша — и виден в личном кабинете отдельно от Opus 5. Удобно запустить новую модель на части трафика и сравнить стоимость маршрутов на реальных запросах.
- Идентификатор в запросе: claude-opus-5-5.
- Ключ, базовый URL и SDK — без изменений.
- Расход виден в кабинете отдельной строкой.