← Назад в блог

21 сентября 2026 г.12 мин • AI Architecture Team

GPT-6 Astra против Claude Fable 5.1: сравнение флагманов OpenAI и Anthropic — цена, бенчмарки, API

Сравнение GPT-6 Astra и Claude Fable 5.1: одинаковая цена 10 и 50 долларов за миллион токенов, разная стоимость кеша, бенчмарки по коду, математике и управлению компьютером, ограничения API и доступ из России.

Коротко: единого победителя нет

GPT-6 Astra вышла 3 сентября 2026 года — почти одновременно с Claude Fable 5.1. Обе модели стоят 10 долларов за миллион входящих токенов и 50 за миллион исходящих, обе работают с контекстом в 1 миллион токенов, обе позиционируются как флагман для длинных автономных задач. На этом сходство заканчивается.

По опубликованным замерам Astra сильнее в управлении компьютером, математике и терминальных агентных задачах. Fable 5.1 впереди в общем рассуждении, в сводных индексах интеллекта и агентного кодинга, и заметно дешевле на длинных сессиях за счёт ставки чтения кеша.

Оговорка, которую стоит держать в голове до конца статьи: большая часть цифр по Astra взята из релиза OpenAI и агрегаторов, которые его пересказывают. Бенчмарки производителя всегда показывают модель с лучшей стороны — это одинаково верно для OpenAI и для Anthropic.

  • Цена входа и выхода одинаковая: 10 и 50 долларов за миллион.
  • Astra — управление компьютером, математика, терминал.
  • Fable 5.1 — общее рассуждение, сводные индексы, дешёвый кеш.

Паспортные данные

По базовым характеристикам модели почти зеркальны. Различия начинаются в строках, на которые при первом знакомстве обычно не смотрят: чтение кеша, наценка за длинный контекст, ускоренный режим и политика хранения данных.

ПараметрGPT-6 AstraClaude Fable 5.1
РазработчикOpenAIAnthropic
Идентификаторgpt-6-astraclaude-fable-5-1
Вход $/1M1010
Выход $/1M5050
Чтение кеша $/1M1,000,25
Контекст1M1M
Наценка за длинный контекстДа, свыше 272K токенов на входеНет, единый прайс
Уровни усилияПять, от low до maxПять, от low до max
Ускоренный режимЕсть, вдвое дорожеНет
Нулевое хранение данныхДоступно по согласованиюНесовместимо без отдельного согласования

Бенчмарки лицом к лицу

Ниже только те тесты, где есть опубликованные цифры по обеим моделям. Там, где результат Fable 5.1 не публиковался, мы не подставляем числа соседних моделей — такие строки просто не попали в таблицу.

Картина получается неровная, и это нормально. Разрыв в математике и распознавании интерфейсов в пользу Astra большой. Разрыв в тесте на общее рассуждение с инструментами в пользу Fable 5.1 тоже большой. В кодинге разница либо в пределах погрешности, либо зависит от того, какой именно тест считать главным.

БенчмаркGPT-6 AstraClaude Fable 5.1Кто впереди
FrontierMath Tier 4 v297,6%87,8%Astra
GPQA Diamond96,0%93,7%Astra
ScreenSpot-Pro (интерфейсы)92,7%87,3%Astra
Terminal-Bench 4.057,7%55,8%Astra, с небольшим отрывом
DeepSWE v1.174,1%69,9%Astra
FrontierCode 1.153,3%53,5%Паритет
Humanity's Last Exam с инструментами57,2%65,0%Fable 5.1
Индекс интеллекта Artificial Analysis6166Fable 5.1
Индекс агентного кодинга6770Fable 5.1

Где GPT-6 Astra сильнее

Главная заявка Astra — управление компьютером. На OSWorld 2.0 модель набирает 72,6% и проходит задачу примерно за 40 минут против 75 минут у предшественницы GPT-5.6 Sol. На ScreenSpot-Pro, где надо точно находить элементы интерфейса на скриншоте, у неё 92,7% против 87,3% у Fable 5.1. Если ваш сценарий — агент, который кликает по чужим интерфейсам без API, это весомый аргумент.

Вторая сильная сторона — математика: 97,6% на FrontierMath Tier 4 против 87,8%. Третья — поиск по длинному контексту: на тесте с восемью иголками в диапазоне от 512 тысяч до миллиона токенов Astra показывает 96,3%.

Наконец, у Astra есть ускоренный режим: до 2,5 раза быстрее за двойную цену. У Fable 5.1 такого режима нет вообще — в линейке Claude он есть только у Opus 5 и Opus 4.8.

  • Управление компьютером и распознавание интерфейсов.
  • Математика исследовательского уровня.
  • Поиск по контексту до миллиона токенов.
  • Ускоренный режим за двойную цену.

Где Claude Fable 5.1 сильнее

Fable 5.1 выигрывает там, где задача не сводится к одной дисциплине. На Humanity's Last Exam с инструментами у неё 65,0% против 57,2% — это самый большой разрыв в её пользу. В сводном индексе интеллекта Artificial Analysis она впереди с 66 против 61, в индексе агентного кодинга — 70 против 67.

Вторая сильная сторона — экономика длинных сессий. Чтение кеша у Fable 5.1 стоит 0,25 доллара за миллион токенов, у Astra — 1 доллар. В агентном сценарии, где стабильный префикс перечитывается на каждом шаге, это четырёхкратная разница на самой объёмной статье счёта. Плюс у Astra запрос, перешагнувший 272 тысячи входящих токенов, переоценивается целиком по удвоенной ставке входа — у Fable 5.1 такого порога нет.

Третья — инструменты для агентов в самом API: смена уровня усилия посреди диалога без сброса кеша, системные сообщения на один ход, заметки о прогрессе между вызовами инструментов.

  • Общее рассуждение и сводные индексы.
  • Чтение кеша вчетверо дешевле.
  • Нет наценки за длинный контекст.
  • Агентные возможности API: усилие на лету, одноходовые системные сообщения.

К чему у обеих моделей есть вопросы

К цифре Astra на ARC-AGI-3 — 99,9% — есть существенная сноска: она получена в обвязке с сохранением состояния, прогон в которой стоит десятки тысяч долларов. В стандартной обвязке без состояния независимые замеры дают от 17 до 63% в зависимости от уровня усилия. Это всё ещё сильный результат, но не «тест решён».

Британский институт безопасности ИИ отметил, что рассуждение Astra стало короче и хуже поддаётся наблюдению: при состязательных промптах модель способна уходить от мониторинга. OpenAI называет это приоритетом исследований. Отдельно: дополнительные проверки безопасности в API не спрашивают подтверждения, а просто останавливают задачу.

У Fable 5.1 свои острые углы. Принудительный вызов инструмента возвращает 400. Префилл ответа не принимается. Редактирование прошлых ходов диалога обесценивает блоки мышления, а у новых аккаунтов даёт ошибку. Отказ по соображениям безопасности приходит с кодом 200, и его надо ловить по причине остановки. И модель недоступна организациям с нулевым сроком хранения данных — у Astra с этим мягче.

  • ARC-AGI-3 у Astra: 99,9% только в дорогой обвязке, в стандартной — 17–63%.
  • Проверки безопасности Astra останавливают задачу в API без запроса.
  • Fable 5.1: нет принудительного вызова инструментов и префилла.
  • Fable 5.1 несовместима с нулевым хранением данных без согласования.

Доступ из России

Здесь модели в одинаковом положении: ни OpenAI, ни Anthropic не принимают российские карты и не обслуживают Россию как регион. Напрямую оплатить API не получится ни там, ни там.

Говорим честно: наш шлюз работает только с моделями Claude. GPT-6 Astra через нас недоступна, и мы не будем делать вид, что это неважно. Если вам нужна именно Astra — ищите шлюз или посредника, который работает с OpenAI, и оценивайте его по тем же критериям, что и любой другой: собственный кабинет, статистика расхода, оферта, чеки.

Fable 5.1 у нас доступна тем же ключом, что и остальные модели Claude: идентификатор claude-fable-5-1 в поле model, оплата в рублях картой или через СБП, VPN не нужен.

Что выбрать

Выбирайте по задаче, а не по бренду. Агент, который работает с графическими интерфейсами, тяжёлая математика, задачи, где важна скорость и не жалко двойной цены за ускоренный режим, — аргументы за Astra.

Длинные исследовательские прогоны, разбор больших противоречивых массивов, агентные сессии на десятки шагов с большим стабильным контекстом, разработка в связке с Claude Code — аргументы за Fable 5.1. На таких сессиях разница в цене кеша превращает одинаковый ценник в заметно разный счёт.

И главный совет: ни одна таблица, включая нашу, не заменит прогона на собственных задачах. Возьмите десять реальных сценариев, прогоните на обеих моделях и сравните не процент на бенчмарке, а стоимость завершённой задачи.

  • Интерфейсы, математика, скорость — GPT-6 Astra.
  • Рассуждение, длинные агентные сессии, экономия на кеше — Fable 5.1.
  • Единица сравнения — завершённая задача на ваших данных.

Что дальше

Если планируете внедрять Claude API в продакшн, начните с понятной структуры тарифа и сразу настройте контроль расхода токенов в личном кабинете.