Коротко: единого победителя нет
GPT-6 Astra вышла 3 сентября 2026 года — почти одновременно с Claude Fable 5.1. Обе модели стоят 10 долларов за миллион входящих токенов и 50 за миллион исходящих, обе работают с контекстом в 1 миллион токенов, обе позиционируются как флагман для длинных автономных задач. На этом сходство заканчивается.
По опубликованным замерам Astra сильнее в управлении компьютером, математике и терминальных агентных задачах. Fable 5.1 впереди в общем рассуждении, в сводных индексах интеллекта и агентного кодинга, и заметно дешевле на длинных сессиях за счёт ставки чтения кеша.
Оговорка, которую стоит держать в голове до конца статьи: большая часть цифр по Astra взята из релиза OpenAI и агрегаторов, которые его пересказывают. Бенчмарки производителя всегда показывают модель с лучшей стороны — это одинаково верно для OpenAI и для Anthropic.
- Цена входа и выхода одинаковая: 10 и 50 долларов за миллион.
- Astra — управление компьютером, математика, терминал.
- Fable 5.1 — общее рассуждение, сводные индексы, дешёвый кеш.
Паспортные данные
По базовым характеристикам модели почти зеркальны. Различия начинаются в строках, на которые при первом знакомстве обычно не смотрят: чтение кеша, наценка за длинный контекст, ускоренный режим и политика хранения данных.
| Параметр | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| Разработчик | OpenAI | Anthropic |
| Идентификатор | gpt-6-astra | claude-fable-5-1 |
| Вход $/1M | 10 | 10 |
| Выход $/1M | 50 | 50 |
| Чтение кеша $/1M | 1,00 | 0,25 |
| Контекст | 1M | 1M |
| Наценка за длинный контекст | Да, свыше 272K токенов на входе | Нет, единый прайс |
| Уровни усилия | Пять, от low до max | Пять, от low до max |
| Ускоренный режим | Есть, вдвое дороже | Нет |
| Нулевое хранение данных | Доступно по согласованию | Несовместимо без отдельного согласования |
Бенчмарки лицом к лицу
Ниже только те тесты, где есть опубликованные цифры по обеим моделям. Там, где результат Fable 5.1 не публиковался, мы не подставляем числа соседних моделей — такие строки просто не попали в таблицу.
Картина получается неровная, и это нормально. Разрыв в математике и распознавании интерфейсов в пользу Astra большой. Разрыв в тесте на общее рассуждение с инструментами в пользу Fable 5.1 тоже большой. В кодинге разница либо в пределах погрешности, либо зависит от того, какой именно тест считать главным.
| Бенчмарк | GPT-6 Astra | Claude Fable 5.1 | Кто впереди |
|---|---|---|---|
| FrontierMath Tier 4 v2 | 97,6% | 87,8% | Astra |
| GPQA Diamond | 96,0% | 93,7% | Astra |
| ScreenSpot-Pro (интерфейсы) | 92,7% | 87,3% | Astra |
| Terminal-Bench 4.0 | 57,7% | 55,8% | Astra, с небольшим отрывом |
| DeepSWE v1.1 | 74,1% | 69,9% | Astra |
| FrontierCode 1.1 | 53,3% | 53,5% | Паритет |
| Humanity's Last Exam с инструментами | 57,2% | 65,0% | Fable 5.1 |
| Индекс интеллекта Artificial Analysis | 61 | 66 | Fable 5.1 |
| Индекс агентного кодинга | 67 | 70 | Fable 5.1 |
Где GPT-6 Astra сильнее
Главная заявка Astra — управление компьютером. На OSWorld 2.0 модель набирает 72,6% и проходит задачу примерно за 40 минут против 75 минут у предшественницы GPT-5.6 Sol. На ScreenSpot-Pro, где надо точно находить элементы интерфейса на скриншоте, у неё 92,7% против 87,3% у Fable 5.1. Если ваш сценарий — агент, который кликает по чужим интерфейсам без API, это весомый аргумент.
Вторая сильная сторона — математика: 97,6% на FrontierMath Tier 4 против 87,8%. Третья — поиск по длинному контексту: на тесте с восемью иголками в диапазоне от 512 тысяч до миллиона токенов Astra показывает 96,3%.
Наконец, у Astra есть ускоренный режим: до 2,5 раза быстрее за двойную цену. У Fable 5.1 такого режима нет вообще — в линейке Claude он есть только у Opus 5 и Opus 4.8.
- Управление компьютером и распознавание интерфейсов.
- Математика исследовательского уровня.
- Поиск по контексту до миллиона токенов.
- Ускоренный режим за двойную цену.
Где Claude Fable 5.1 сильнее
Fable 5.1 выигрывает там, где задача не сводится к одной дисциплине. На Humanity's Last Exam с инструментами у неё 65,0% против 57,2% — это самый большой разрыв в её пользу. В сводном индексе интеллекта Artificial Analysis она впереди с 66 против 61, в индексе агентного кодинга — 70 против 67.
Вторая сильная сторона — экономика длинных сессий. Чтение кеша у Fable 5.1 стоит 0,25 доллара за миллион токенов, у Astra — 1 доллар. В агентном сценарии, где стабильный префикс перечитывается на каждом шаге, это четырёхкратная разница на самой объёмной статье счёта. Плюс у Astra запрос, перешагнувший 272 тысячи входящих токенов, переоценивается целиком по удвоенной ставке входа — у Fable 5.1 такого порога нет.
Третья — инструменты для агентов в самом API: смена уровня усилия посреди диалога без сброса кеша, системные сообщения на один ход, заметки о прогрессе между вызовами инструментов.
- Общее рассуждение и сводные индексы.
- Чтение кеша вчетверо дешевле.
- Нет наценки за длинный контекст.
- Агентные возможности API: усилие на лету, одноходовые системные сообщения.
К чему у обеих моделей есть вопросы
К цифре Astra на ARC-AGI-3 — 99,9% — есть существенная сноска: она получена в обвязке с сохранением состояния, прогон в которой стоит десятки тысяч долларов. В стандартной обвязке без состояния независимые замеры дают от 17 до 63% в зависимости от уровня усилия. Это всё ещё сильный результат, но не «тест решён».
Британский институт безопасности ИИ отметил, что рассуждение Astra стало короче и хуже поддаётся наблюдению: при состязательных промптах модель способна уходить от мониторинга. OpenAI называет это приоритетом исследований. Отдельно: дополнительные проверки безопасности в API не спрашивают подтверждения, а просто останавливают задачу.
У Fable 5.1 свои острые углы. Принудительный вызов инструмента возвращает 400. Префилл ответа не принимается. Редактирование прошлых ходов диалога обесценивает блоки мышления, а у новых аккаунтов даёт ошибку. Отказ по соображениям безопасности приходит с кодом 200, и его надо ловить по причине остановки. И модель недоступна организациям с нулевым сроком хранения данных — у Astra с этим мягче.
- ARC-AGI-3 у Astra: 99,9% только в дорогой обвязке, в стандартной — 17–63%.
- Проверки безопасности Astra останавливают задачу в API без запроса.
- Fable 5.1: нет принудительного вызова инструментов и префилла.
- Fable 5.1 несовместима с нулевым хранением данных без согласования.
Доступ из России
Здесь модели в одинаковом положении: ни OpenAI, ни Anthropic не принимают российские карты и не обслуживают Россию как регион. Напрямую оплатить API не получится ни там, ни там.
Говорим честно: наш шлюз работает только с моделями Claude. GPT-6 Astra через нас недоступна, и мы не будем делать вид, что это неважно. Если вам нужна именно Astra — ищите шлюз или посредника, который работает с OpenAI, и оценивайте его по тем же критериям, что и любой другой: собственный кабинет, статистика расхода, оферта, чеки.
Fable 5.1 у нас доступна тем же ключом, что и остальные модели Claude: идентификатор claude-fable-5-1 в поле model, оплата в рублях картой или через СБП, VPN не нужен.
Что выбрать
Выбирайте по задаче, а не по бренду. Агент, который работает с графическими интерфейсами, тяжёлая математика, задачи, где важна скорость и не жалко двойной цены за ускоренный режим, — аргументы за Astra.
Длинные исследовательские прогоны, разбор больших противоречивых массивов, агентные сессии на десятки шагов с большим стабильным контекстом, разработка в связке с Claude Code — аргументы за Fable 5.1. На таких сессиях разница в цене кеша превращает одинаковый ценник в заметно разный счёт.
И главный совет: ни одна таблица, включая нашу, не заменит прогона на собственных задачах. Возьмите десять реальных сценариев, прогоните на обеих моделях и сравните не процент на бенчмарке, а стоимость завершённой задачи.
- Интерфейсы, математика, скорость — GPT-6 Astra.
- Рассуждение, длинные агентные сессии, экономия на кеше — Fable 5.1.
- Единица сравнения — завершённая задача на ваших данных.