← Назад в блог

19 сентября 2026 г.9 мин • AI Architecture Team

Цена GPT-6 Astra и Claude Fable 5.1: одинаковый ценник, разный счёт — считаем на примерах

Сравнение стоимости GPT-6 Astra и Claude Fable 5.1: вход и выход по 10 и 50 долларов, чтение кеша 1,00 против 0,25, наценка OpenAI за контекст свыше 272 тысяч токенов, пакетный и ускоренный режимы, расчёты на примерах.

Одинаковый ценник — не случайность

OpenAI выпустила GPT-6 Astra с ценой 10 долларов за миллион входящих токенов и 50 за миллион исходящих — цифра в цифру как у Claude Fable 5.1. Для OpenAI это в два с половиной раза дороже предыдущего флагмана GPT-5.6 Sol с его акционными 4 и 20 долларами.

Но вход и выход — это две строки прайса из пяти-шести. Остальные строки у моделей разные, и именно они определяют счёт в агентных сценариях, ради которых обе модели и созданы.

Полный прайс

Цены в долларах за миллион токенов. У Astra две колонки, потому что запрос с входом больше 272 тысяч токенов тарифицируется по отдельной сетке — причём целиком, а не только в части сверх порога.

СтатьяAstra до 272KAstra свыше 272KFable 5.1
Входящие токены102010
Чтение кеша1,002,000,25
Запись в кеш12,52512,5 (5 минут) / 20 (1 час)
Исходящие токены507550
Пакетный режим, вход / выход5 / 255 / 25
Ускоренный режим, вход / выход20 / 100Нет

Кеш: главная разница

Агент на каждом шаге заново отправляет системный промпт, описания инструментов и всю историю. Этот стабильный префикс обслуживается из кеша, и в длинной сессии именно он составляет основной объём входящих токенов.

Кешированный токен у Astra стоит 1 доллар за миллион — десятую часть обычного входа. У Fable 5.1 — 0,25 доллара, сороковую часть. На сессии в 50 шагов с префиксом 120 тысяч токенов набегает 6 миллионов прочитанных из кеша токенов: 6 долларов против полутора.

Без кеширования обе модели обошлись бы на этом объёме в одинаковые 60 долларов. То есть кеш нужен в обоих случаях — просто у Fable 5.1 он экономит 97% этой статьи, а у Astra — 90%.

  • Astra: кеш в 10 раз дешевле обычного входа.
  • Fable 5.1: кеш в 40 раз дешевле обычного входа.
  • На длинных сессиях это основная статья счёта.

Порог 272 тысячи токенов

Вторая неочевидная строка прайса Astra. Пока вход запроса не превышает 272 тысяч токенов, действует базовая сетка. Как только превышает — весь запрос, а не только излишек, считается по удвоенной ставке входа и кеша и по полуторной ставке выхода.

Окно в миллион токенов у Astra при этом честное, и поиск по нему работает отлично — 96,3% на тесте с восемью иголками в диапазоне до миллиона. Но пользоваться этим окном дороже, чем следует из первой строки прайса.

У Fable 5.1 прайс единый на всё окно. Запрос на 100 тысяч токенов и запрос на 800 тысяч тарифицируются по одной ставке.

Считаем на примерах

Возьмём три типичных запроса и посчитаем каждый по обеим сеткам. Первый — шаг агента в средней сессии: 100 тысяч токенов из кеша, 10 тысяч новых, 3 тысячи на выход. Второй — шаг в длинной сессии по большому репозиторию: 380 тысяч из кеша, 20 тысяч новых, 5 тысяч на выход. Третий — разовый запрос без кеша: 20 тысяч на вход, 4 тысячи на выход.

На коротком запросе без кеша цены совпадают до цента. На среднем шаге агента Astra дороже примерно на четверть. На длинном — почти втрое, потому что складываются оба эффекта: дорогой кеш и переоценка всего запроса за порогом.

СценарийGPT-6 AstraClaude Fable 5.1Разница
Разовый запрос без кеша (20K + 4K)0,40 $0,40 $Нет
Шаг агента (100K кеш + 10K + 3K)0,35 $0,28 $Astra дороже на 27%
Шаг за порогом (380K кеш + 20K + 5K)1,54 $0,55 $Astra дороже в 2,8 раза
50 шагов агента среднего размераоколо 17,5 $около 13,8 $Astra дороже на 27%

Пакетный, гибкий и ускоренный режимы

Пакетная обработка со скидкой 50% есть у обеих моделей: 5 и 25 долларов за миллион. Если результат не нужен немедленно — ночная разметка, массовая обработка документов, — это самый простой способ срезать счёт вдвое.

У Astra есть ещё два режима. Гибкий — те же 5 и 25 долларов за готовность подождать при обычном синхронном вызове. И ускоренный — до 2,5 раза быстрее за двойную цену, 20 и 100 долларов. У Fable 5.1 ускоренного режима нет, как и приоритетного тарифа.

Если скорость ответа для вас критична и бюджет позволяет, это реальное преимущество Astra. В линейке Claude ускоренный режим есть только у Opus 5 и Opus 4.8.

  • Пакетный режим: минус 50% у обеих моделей.
  • Гибкий режим со скидкой — только у Astra.
  • Ускоренный режим за двойную цену — только у Astra.

Токен не равен токену

У расчётов выше есть принципиальное ограничение: они предполагают одинаковое число токенов на одну и ту же задачу. В реальности это не так. У моделей разные токенизаторы — один и тот же русский текст превращается в разное число токенов. И разная многословность рассуждения, которое у обеих тарифицируется по цене выхода.

OpenAI сообщает, что Astra тратит примерно на 10% меньше исходящих токенов, чем GPT-5.6 Sol, а на задачах по коду — около трети от прежнего расхода. По независимым замерам, прогон стандартного набора тестов на максимальном усилии стоит у Astra вчетверо дороже, чем на минимальном. У Fable 5.1 уровень усилия влияет на счёт так же сильно.

Поэтому честный ответ на вопрос «что дешевле» выглядит так: на структуре прайса выигрывает Fable 5.1, и чем длиннее сессия, тем сильнее. А итоговую стоимость вашей задачи покажет только замер на ваших данных с настроенным кешем и подобранным уровнем усилия.

Вывод

Разовые короткие запросы стоят одинаково — выбирайте по качеству на вашей задаче. Пакетная обработка стоит одинаково. Агентные сессии с кешем на Fable 5.1 дешевле на четверть и более. Работа с контекстом за 272 тысячи токенов на Fable 5.1 дешевле в разы. Нужна максимальная скорость любой ценой — это умеет только Astra.

В нашем кабинете расход по Fable 5.1 виден отдельной строкой, включая токены, прочитанные из кеша, — так что свою реальную стоимость шага агента можно увидеть, а не оценивать по статьям. Оплата в рублях, картой или через СБП.

  • Короткие запросы и батчи — паритет.
  • Агентные сессии с кешем — дешевле Fable 5.1.
  • Контекст свыше 272K — Fable 5.1 дешевле в разы.
  • Скорость за деньги — только Astra.

Что дальше

Если планируете внедрять Claude API в продакшн, начните с понятной структуры тарифа и сразу настройте контроль расхода токенов в личном кабинете.