Главное про Sonnet 5
Claude Sonnet 5 — средняя модель поколения. Идентификатор claude-sonnet-5, контекст 1 миллион токенов, до 128 тысяч на выход, цена 2 доллара за миллион входящих и 10 за миллион исходящих.
Самое заметное изменение относительно предыдущей версии — цена. Sonnet 4.6 стоил 3 и 15 долларов, Sonnet 5 стоит 2 и 10. Это минус треть по обеим статьям при том же миллионном контексте, то есть редкий случай, когда обновление модели прямо снижает счёт.
| Параметр | Sonnet 5 | Sonnet 4.6 | Opus 5 |
|---|---|---|---|
| Вход $/1M | 2 | 3 | 5 |
| Выход $/1M | 10 | 15 | 25 |
| Контекст | 1M | 1M | 1M |
| Максимум на выход | 128K | 128K | 128K |
| Уровень xhigh | Есть | Нет | Есть |
Мышление и усилие
Единственный режим включённого рассуждения — адаптивный. Если параметр thinking не передан, адаптивное мышление всё равно работает; явное отключение при этом принимается, в отличие от Fable 5.
Уровни усилия — все пять, от low до max, включая xhigh. Именно xhigh считается лучшим выбором для кодинга и агентных сценариев на моделях этого поколения, а по умолчанию, если усилие не задано, применяется high.
Фиксированный бюджет токенов на размышление на Sonnet 5 удалён и возвращает 400. Параметры сэмплирования — тоже. Префилл ответа ассистента не принимается.
- Адаптивное мышление — единственный режим «включено».
- Пять уровней усилия, по умолчанию high.
- budget_tokens, temperature, top_p, top_k и префилл — ошибка 400.
Чего у Sonnet 5 нет
Три отличия от Opus 5, о которых стоит знать заранее. Системные сообщения в середине диалога на Sonnet 5 не поддерживаются — попытка положить сообщение с ролью system в массив сообщений вернёт ошибку про неподдерживаемую роль. Операторские инструкции придётся класть в верхнеуровневый системный промпт, а это ломает кешированный префикс.
Fast mode на Sonnet 5 отсутствует — он существует только для Opus 5 и Opus 4.8. Приоритетный тариф Sonnet 5 тоже не покрывает.
Бюджеты задач, наоборот, поддерживаются — их можно использовать так же, как на Opus 5.
- Нет системных сообщений в середине диалога.
- Нет fast mode и приоритетного тарифа.
- Бюджеты задач работают.
Когда Sonnet 5 достаточно вместо Opus 5
Sonnet 5 в два с половиной раза дешевле Opus 5 по обеим статьям. Практическая стратегия проста: начните с Sonnet 5, замерьте качество на своих реальных примерах и поднимайтесь до Opus только там, где Sonnet систематически ошибается.
Типовые продуктовые задачи Sonnet 5 закрывает уверенно: генерация кода по описанию, рефакторинг, извлечение и переработка текста, поддержка чат-интерфейсов, разбор документов. Разница с Opus проявляется на задачах, где нужно одновременно удерживать много связей: архитектурные решения, длинные агентные цепочки, отладка нетривиальных сбоев.
Отдельно про агентов: в многоагентной схеме имеет смысл ставить Opus 5 на главный цикл, а подзадачи отдавать Sonnet 5 или Haiku 4.5 с низким усилием. Экономия там измеряется разами, а не процентами.
- Замеряйте на своих примерах, а не на общих бенчмарках.
- Повышайте модель точечно, а не для всего сервиса сразу.
- Подзадачи агента — более дешёвая модель и низкое усилие.
Переход с Sonnet 4.6 на Sonnet 5
Смена идентификатора — необходимое, но не достаточное действие. Проверить нужно три вещи: не осталось ли в запросах budget_tokens (на 4.6 он ещё работал как переходная мера, на 5 возвращает 400), не используются ли параметры сэмплирования и не изменилось ли поведение интерфейса из-за отображения мышления.
Последнее — самое незаметное. На Sonnet 4.6 резюме рассуждения приходило по умолчанию, на Sonnet 5 умолчание изменилось на пустое. Интерфейс, который показывал ход мысли, просто перестанет что-либо показывать, и ошибки в логах при этом не будет.
- Уберите budget_tokens — на пятёрке это 400.
- Уберите temperature и родственные параметры.
- Если показываете ход рассуждения — запросите отображение явно.