Почему сравнение изменилось
Неделю назад мы сравнивали GPT-6 Astra с Claude Opus 5 и пришли к выводу: Astra вдвое дороже и окупает это только в нескольких узких сценариях. С выходом Opus 5.5 картина сдвинулась ещё сильнее в сторону Claude по деньгам — новый Opus дешевле предыдущего на 20% по входу и выходу и в 2,5 раза по чтению кеша.
Сразу о главной оговорке. На момент публикации у нас нет результатов Opus 5.5 на тех же бенчмарках, что опубликованы для Astra, поэтому сравнение качества в этой статье опирается на цифры Opus 5 как на ориентир для линейки. Цены, условия тарификации и различия API — точные.
| Параметр | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|
| Идентификатор | gpt-6-astra | claude-opus-5-5 |
| Вход / выход $/1M | 10 / 50 | 4 / 20 |
| Чтение кеша $/1M | 1,00 | 0,20 |
| Вход свыше 272K токенов | Вход 20, кеш 2, выход 75 | Без надбавки |
| Пакетный режим $/1M | 5 / 25 | 2 / 10 |
| Ускоренный режим $/1M | 20 / 100 | 8 / 40 |
| Контекст | 1M | 1M |
| Уровни усилия | low — max | low — max, по умолчанию medium |
| Принудительный вызов инструмента | Есть | Нет, ошибка 400 |
| Граница знаний | 30 апреля 2026 | Июнь 2026 |
Прайс: 2,5 раза на токенах, 5 раз на кеше
На входе и выходе Astra дороже Opus 5.5 в 2,5 раза. На чтении кеша — в 5 раз: 1,00 доллара против 0,20 за миллион. Для агентных сценариев именно эта строка важнее всего, потому что основной объём входа в длинной сессии — повторно отправляемый стабильный префикс.
Дальше вступает порог длинного контекста. Если на вход Astra приходит больше 272 тысяч токенов, весь запрос тарифицируется по повышенной ставке: вход 20, кеш 2, выход 75 долларов. У Opus 5.5 такой надбавки нет на всём миллионе токенов. На длинных контекстах разрыв вырастает до 5 раз по входу, 10 раз по кешу и 3,75 раза по выходу.
Ускоренный и пакетный режимы сохраняют ту же пропорцию: fast mode у Astra стоит 20 и 100, у Opus 5.5 — 8 и 40; пакетная обработка — 5 и 25 против 2 и 10.
- Вход и выход — в 2,5 раза дешевле у Opus 5.5.
- Чтение кеша — в 5 раз дешевле у Opus 5.5.
- Свыше 272K токенов Astra дорожает, Opus 5.5 — нет.
Считаем на двух сценариях
Сценарий 1 — обычная агентная сессия: 100 запросов, в каждом 60 тысяч токенов префикса из кеша, 2 тысячи новых входящих и 3 тысячи исходящих. Astra: 0,06 доллара за кеш, 0,02 за вход, 0,15 за выход — 0,23 за запрос, 23 доллара за сессию. Opus 5.5: 0,012 + 0,008 + 0,06 = 0,08 за запрос, около 8,30 за сессию с учётом записи кеша. Разница почти втрое.
Сценарий 2 — работа с большой кодовой базой, где контекст перевалил за порог: 295 тысяч токенов из кеша, 5 тысяч новых, 3 тысячи на выход. Astra по повышенной ставке: 0,59 + 0,10 + 0,225 = 0,915 доллара за запрос. Opus 5.5: 0,059 + 0,02 + 0,06 = 0,139. Разница в 6,6 раза.
Две поправки к этим цифрам. Токенизаторы у моделей разные, поэтому один и тот же текст занимает у них разное число токенов. И OpenAI заявляет, что на задачах по коду Astra тратит примерно треть исходящих токенов от предыдущей своей модели; как это соотносится с расходом Opus 5.5, опубликованных данных нет. Обе поправки могут сдвинуть результат, но не на порядок — сравнивайте на своих задачах по стоимости выполненной задачи.
| Сценарий | GPT-6 Astra | Claude Opus 5.5 | Разница |
|---|---|---|---|
| Агентная сессия, 100 запросов | ≈ $23,00 | ≈ $8,30 | ≈ 2,8× |
| Один запрос с контекстом 300K | $0,915 | $0,139 | ≈ 6,6× |
Где Astra отрабатывает переплату
Здесь мы опираемся на опубликованные результаты Astra и Opus 5. Исследовательская математика: 97,6% на FrontierMath Tier 4 против 73,2% у Opus 5 — это другой класс результата, и если ваши задачи в этой области, Astra стоит попробовать при любом ценнике.
Управление компьютером: на OSWorld 2.0 разница с Opus 5 небольшая — 72,6% против 70,2%, — но Astra заметно реже совершает нежелательные действия: 2,4% против 11,5% в сценариях управления компьютером. Для агента, который без присмотра работает с боевыми данными, это весомый аргумент.
Терминальные агентные задачи: плюс 5,4 пункта у Astra на Terminal-Bench 4.0 относительно Opus 5.
Насколько Opus 5.5 сокращает эти разрывы, покажут только замеры. Если одна из этих задач для вас основная — прогоните обе модели на своём наборе, прежде чем принимать решение.
- Исследовательская математика.
- Агенты с доступом к реальной машине.
- Автономные терминальные задачи.
Где Opus 5.5 выгоднее
Сложный код: на FrontierCode Astra и Opus 5 показали одинаковые 53%. Если паритет сохраняется и для Opus 5.5, вы получаете тот же результат за 40% цены — а на длинных контекстах за долю от неё.
Общее рассуждение с инструментами: на Humanity's Last Exam Opus 5 опережал Astra на 6,4 пункта. Более дешёвая линейка здесь была просто лучше.
Длинные сессии с большим контекстом: чтение кеша за 0,20 и отсутствие порога 272K делают Opus 5.5 кратно дешевле ровно там, где счёт за ИИ обычно и растёт — в агентной разработке по большим репозиториям.
И экосистема: Claude Code, навыки, хуки и инструменты по MCP остаются на стороне Anthropic. Если вы уже работаете в ней, переезд на Astra — это не смена идентификатора, а перестройка процесса.
- Код — паритет у Opus 5 при цене в 2,5 раза ниже у Opus 5.5.
- Рассуждение с инструментами — линейка Opus впереди.
- Большой контекст — разница в счёте до 6–10 раз.
Отличия API, которые важны при выборе
Принудительный вызов инструмента. У Astra он есть, у Opus 5.5 — нет: tool_choice со значениями any и tool возвращает 400. Если ваша логика построена на гарантированном вызове конкретного инструмента, на Opus 5.5 её придётся перестроить на auto со строгой схемой и проверкой вызова или на структурированный вывод.
Мышление. У Opus 5.5 оно всегда включено, а глубина задаётся уровнем усилия; по умолчанию стоит medium. У Astra пять таких же уровней. В обоих случаях усилие — главный рычаг стоимости и его стоит задавать явно на каждом маршруте.
Остановки по безопасности. Защитные проверки Astra в API останавливают задачу без возможности подтвердить действие. У Opus 5.5 отказ приходит обычным ответом с причиной остановки refusal, и на этот случай есть механизм запасной модели: тот же запрос повторяется на другой модели внутри одного вызова. Для автономных прогонов оба случая нужно обрабатывать явно.
Доступ. Astra — в API OpenAI и Amazon Bedrock. Opus 5.5 — в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry; fast mode у него есть только в Claude API.
Итог
По деньгам сравнение однозначное: Opus 5.5 дешевле Astra в 2,5 раза на обычных запросах, в 5 раз на чтении кеша и в 6–10 раз на контекстах больше 272 тысяч токенов. По качеству Astra впереди линейки Opus в математике и в безопасности агента на реальной машине; в коде и общем рассуждении с инструментами преимущество у неё не просматривалось уже на Opus 5.
Разумная стратегия — та же, что мы советовали для Opus 5: основную нагрузку держать на Claude, а под задачу, где Astra выигрывает кратно, завести отдельный маршрут после замера на своих данных.
Opus 5.5 доступен через наш шлюз с оплатой в рублях — достаточно указать claude-opus-5-5 в запросе, fast mode тоже поддерживается. GPT-6 Astra у нас нет: мы работаем только с моделями Anthropic.