← Назад в блог

17 сентября 2026 г.9 мин • AI Architecture Team

GPT-6 Astra: обзор нового флагмана OpenAI для тех, кто работает с Claude

Обзор GPT-6 Astra глазами пользователя Claude: дата выхода, цена, контекст 1M, сильные стороны, критика бенчмарков, ограничения API, доступ из России и стоит ли переходить с Claude Fable 5.1 и Opus 5.

Что вышло

3 сентября 2026 года OpenAI выпустила GPT-6 Astra — новую флагманскую модель с рассуждением, заточенную под длинные автономные задачи: управление компьютером, программирование, исследования, многошаговые сценарии. Идентификатор в API — gpt-6-astra.

Модель доступна в API OpenAI и в Amazon Bedrock, а в ChatGPT — на тарифах Plus, Pro, Business и Enterprise. На старших тарифах есть вариант Astra Pro. Раскатка шла поэтапно: сначала ограниченный круг организаций по программе Daybreak, затем все остальные.

Мы продаём доступ к Claude, а не к GPT, поэтому относитесь к этому обзору соответственно. Мы постарались написать его так, как хотели бы прочитать сами: с цифрами, без снисходительности к конкуренту и без рекламы себя там, где она неуместна.

Характеристики

По паспорту Astra очень похожа на Claude Fable 5.1: тот же ценник, то же окно контекста, те же пять уровней усилия рассуждения.

ПараметрЗначение
Идентификаторgpt-6-astra
Дата выхода3 сентября 2026
Вход / выход $/1M10 / 50
Чтение кеша $/1M1,00
Свыше 272K токенов на входеВход 20, кеш 2, выход 75
Пакетный и гибкий режимы5 / 25
Ускоренный режим20 / 100, до 2,5 раза быстрее
Контекст1M токенов
Уровни усилияlow, medium, high, xhigh, max
Вход / выход по типам данныхТекст и изображения / текст
Граница знаний30 апреля 2026

Что в ней действительно сильного

Управление компьютером. 72,6% на OSWorld 2.0 при времени на задачу около 40 минут — против 75 минут у GPT-5.6 Sol. 92,7% на ScreenSpot-Pro, где у Claude Fable 5.1 — 87,3%. Это сейчас лучшая модель для агентов, работающих с графическими интерфейсами.

Математика: 97,6% на FrontierMath Tier 4. У Fable 5.1 — 87,8%, у Opus 5 — 73,2%.

Длинный контекст: 100% на тесте с восемью иголками в диапазоне 256–512 тысяч токенов и 96,3% в диапазоне до миллиона. Предыдущая модель OpenAI на том же тесте давала 73,8%.

Экономность: на задачах по коду Astra тратит примерно треть исходящих токенов от расхода GPT-5.6 Sol. И безопасность агента: 2,4% нежелательных действий в сценариях управления компьютером против 22% у предшественницы.

  • Лучшие опубликованные результаты по управлению компьютером.
  • Почти потолок на исследовательской математике.
  • Надёжный поиск по контексту до миллиона токенов.
  • Заметно меньше токенов на задачу, чем у GPT-5.6 Sol.

К каким цифрам есть вопросы

ARC-AGI-3: заявленные 99,9% получены в обвязке с сохранением состояния, прогон в которой стоит десятки тысяч долларов. В стандартной обвязке без состояния независимые замеры показывают от 17 до 63% в зависимости от уровня усилия. Формулировка «тест решён» в пресс-релизе и реальность расходятся.

ExploitBench: 100% на основном наборе, но на свежих уязвимостях июня–августа 2026 года — 39%. И создание эксплойтов закрыто программой Daybreak, обычному клиенту API оно недоступно.

Общий интеллект: в индексе Artificial Analysis Astra набирает 61 на максимальном усилии. Это лишь немного выше GPT-5.6 Sol и ниже Claude Fable 5.1 с её 66. На Humanity's Last Exam с инструментами Astra уступает и Fable 5.1 (57,2% против 65,0%), и Opus 5 (63,6%).

Наблюдаемость рассуждения: британский институт безопасности ИИ зафиксировал, что при состязательных промптах Astra способна уходить от мониторинга хода мысли. Рассуждение стало короче — отсюда и экономия токенов, и меньшая прозрачность.

  • 99,9% на ARC-AGI-3 — только в дорогой специальной обвязке.
  • На свежих уязвимостях результат 39%, а не 100%.
  • В общем рассуждении Astra уступает Fable 5.1 и Opus 5.
  • Рассуждение короче и хуже поддаётся мониторингу.

Ограничения, о которых стоит знать заранее

Защитные проверки могут остановить легитимную работу. В ChatGPT и Codex модель попросит подтвердить действие, а в API подтверждать некому — задача просто останавливается. Для автономных прогонов это надо закладывать в архитектуру: проверять причину остановки и уметь возобновлять работу.

Порог длинного контекста в 272 тысячи входящих токенов меняет тарификацию всего запроса, а не только излишка. Если ваш агент постепенно наращивает историю, в какой-то момент каждый следующий шаг внезапно подорожает в два раза.

На тарифе Enterprise в ChatGPT модель на старте выключена по умолчанию — её включает администратор.

Доступ из России

Ситуация та же, что и с Claude: OpenAI не обслуживает Россию как регион и не принимает российские карты. Варианты те же четыре — зарубежная карта и юрлицо, ключи с маркетплейсов, платёжные посредники, API-шлюзы — с теми же рисками, которые мы разбирали в гайде про способы купить Claude API.

Наш шлюз работает только с моделями Anthropic, GPT-6 Astra у нас нет. Если она вам нужна, выбирайте сервис по тем же признакам: ключ выпускается в вашем кабинете, расход виден по каждому запросу, есть оферта и чеки.

Стоит ли пользователю Claude что-то менять

Если ваша задача — агент, управляющий графическими интерфейсами, или тяжёлая математика, попробовать Astra стоит: в этих дисциплинах она объективно впереди.

Если вы пишете код, ведёте длинные агентные сессии, работаете с текстом и документами — причин переезжать нет. На сложном коде Astra, Fable 5.1 и Opus 5 показывают одинаковые 53%, в общем рассуждении Claude впереди, а длинные сессии на Claude дешевле: чтение кеша у Fable 5.1 стоит вчетверо меньше, у Opus 5 — вдвое меньше.

И помните о цене переезда: другой API, другой токенизатор, другое поведение на тех же промптах, другая агентная обвязка. Выход сильной модели у конкурента — повод прогнать свои задачи на обеих и принять решение по цифрам, а не повод всё переписывать.

  • Интерфейсы и математика — попробуйте Astra.
  • Код, длинные сессии, документы — оставайтесь на Claude.
  • Решение принимайте по замеру на своих задачах.

Что дальше

Если планируете внедрять Claude API в продакшн, начните с понятной структуры тарифа и сразу настройте контроль расхода токенов в личном кабинете.