Что вышло
3 сентября 2026 года OpenAI выпустила GPT-6 Astra — новую флагманскую модель с рассуждением, заточенную под длинные автономные задачи: управление компьютером, программирование, исследования, многошаговые сценарии. Идентификатор в API — gpt-6-astra.
Модель доступна в API OpenAI и в Amazon Bedrock, а в ChatGPT — на тарифах Plus, Pro, Business и Enterprise. На старших тарифах есть вариант Astra Pro. Раскатка шла поэтапно: сначала ограниченный круг организаций по программе Daybreak, затем все остальные.
Мы продаём доступ к Claude, а не к GPT, поэтому относитесь к этому обзору соответственно. Мы постарались написать его так, как хотели бы прочитать сами: с цифрами, без снисходительности к конкуренту и без рекламы себя там, где она неуместна.
Характеристики
По паспорту Astra очень похожа на Claude Fable 5.1: тот же ценник, то же окно контекста, те же пять уровней усилия рассуждения.
| Параметр | Значение |
|---|---|
| Идентификатор | gpt-6-astra |
| Дата выхода | 3 сентября 2026 |
| Вход / выход $/1M | 10 / 50 |
| Чтение кеша $/1M | 1,00 |
| Свыше 272K токенов на входе | Вход 20, кеш 2, выход 75 |
| Пакетный и гибкий режимы | 5 / 25 |
| Ускоренный режим | 20 / 100, до 2,5 раза быстрее |
| Контекст | 1M токенов |
| Уровни усилия | low, medium, high, xhigh, max |
| Вход / выход по типам данных | Текст и изображения / текст |
| Граница знаний | 30 апреля 2026 |
Что в ней действительно сильного
Управление компьютером. 72,6% на OSWorld 2.0 при времени на задачу около 40 минут — против 75 минут у GPT-5.6 Sol. 92,7% на ScreenSpot-Pro, где у Claude Fable 5.1 — 87,3%. Это сейчас лучшая модель для агентов, работающих с графическими интерфейсами.
Математика: 97,6% на FrontierMath Tier 4. У Fable 5.1 — 87,8%, у Opus 5 — 73,2%.
Длинный контекст: 100% на тесте с восемью иголками в диапазоне 256–512 тысяч токенов и 96,3% в диапазоне до миллиона. Предыдущая модель OpenAI на том же тесте давала 73,8%.
Экономность: на задачах по коду Astra тратит примерно треть исходящих токенов от расхода GPT-5.6 Sol. И безопасность агента: 2,4% нежелательных действий в сценариях управления компьютером против 22% у предшественницы.
- Лучшие опубликованные результаты по управлению компьютером.
- Почти потолок на исследовательской математике.
- Надёжный поиск по контексту до миллиона токенов.
- Заметно меньше токенов на задачу, чем у GPT-5.6 Sol.
К каким цифрам есть вопросы
ARC-AGI-3: заявленные 99,9% получены в обвязке с сохранением состояния, прогон в которой стоит десятки тысяч долларов. В стандартной обвязке без состояния независимые замеры показывают от 17 до 63% в зависимости от уровня усилия. Формулировка «тест решён» в пресс-релизе и реальность расходятся.
ExploitBench: 100% на основном наборе, но на свежих уязвимостях июня–августа 2026 года — 39%. И создание эксплойтов закрыто программой Daybreak, обычному клиенту API оно недоступно.
Общий интеллект: в индексе Artificial Analysis Astra набирает 61 на максимальном усилии. Это лишь немного выше GPT-5.6 Sol и ниже Claude Fable 5.1 с её 66. На Humanity's Last Exam с инструментами Astra уступает и Fable 5.1 (57,2% против 65,0%), и Opus 5 (63,6%).
Наблюдаемость рассуждения: британский институт безопасности ИИ зафиксировал, что при состязательных промптах Astra способна уходить от мониторинга хода мысли. Рассуждение стало короче — отсюда и экономия токенов, и меньшая прозрачность.
- 99,9% на ARC-AGI-3 — только в дорогой специальной обвязке.
- На свежих уязвимостях результат 39%, а не 100%.
- В общем рассуждении Astra уступает Fable 5.1 и Opus 5.
- Рассуждение короче и хуже поддаётся мониторингу.
Ограничения, о которых стоит знать заранее
Защитные проверки могут остановить легитимную работу. В ChatGPT и Codex модель попросит подтвердить действие, а в API подтверждать некому — задача просто останавливается. Для автономных прогонов это надо закладывать в архитектуру: проверять причину остановки и уметь возобновлять работу.
Порог длинного контекста в 272 тысячи входящих токенов меняет тарификацию всего запроса, а не только излишка. Если ваш агент постепенно наращивает историю, в какой-то момент каждый следующий шаг внезапно подорожает в два раза.
На тарифе Enterprise в ChatGPT модель на старте выключена по умолчанию — её включает администратор.
Доступ из России
Ситуация та же, что и с Claude: OpenAI не обслуживает Россию как регион и не принимает российские карты. Варианты те же четыре — зарубежная карта и юрлицо, ключи с маркетплейсов, платёжные посредники, API-шлюзы — с теми же рисками, которые мы разбирали в гайде про способы купить Claude API.
Наш шлюз работает только с моделями Anthropic, GPT-6 Astra у нас нет. Если она вам нужна, выбирайте сервис по тем же признакам: ключ выпускается в вашем кабинете, расход виден по каждому запросу, есть оферта и чеки.
Стоит ли пользователю Claude что-то менять
Если ваша задача — агент, управляющий графическими интерфейсами, или тяжёлая математика, попробовать Astra стоит: в этих дисциплинах она объективно впереди.
Если вы пишете код, ведёте длинные агентные сессии, работаете с текстом и документами — причин переезжать нет. На сложном коде Astra, Fable 5.1 и Opus 5 показывают одинаковые 53%, в общем рассуждении Claude впереди, а длинные сессии на Claude дешевле: чтение кеша у Fable 5.1 стоит вчетверо меньше, у Opus 5 — вдвое меньше.
И помните о цене переезда: другой API, другой токенизатор, другое поведение на тех же промптах, другая агентная обвязка. Выход сильной модели у конкурента — повод прогнать свои задачи на обеих и принять решение по цифрам, а не повод всё переписывать.
- Интерфейсы и математика — попробуйте Astra.
- Код, длинные сессии, документы — оставайтесь на Claude.
- Решение принимайте по замеру на своих задачах.