Anthropic выпустила Claude Sonnet 5.5 — почти как Opus, но дешевле
Anthropic выпустила Claude Sonnet 5.5 — вторую модель в семействе Claude 5.5. Она почти догоняет Opus 5.5 на бенчмарках, генерирует ответы более чем на 30% быстрее и обходится до 30% дешевле на задачу.
- На Terminal-Bench 4.0 Sonnet 5.5 набирает 70,6% против 10,3% у Sonnet 5.
- На GDPval-AA модель набирает 1 844 балла — почти столько же, сколько Opus 5.5 (1 846).
- Цена за миллион токенов не изменилась: $2 за входные и $10 за выходные.

Anthropic выпустила Claude Sonnet 5.5 — вторую модель в семействе Claude 5.5. По данным компании, она генерирует ответы более чем на 30% быстрее, стоит до 30% меньше на задачу и почти догоняет Opus 5.5 на нескольких бенчмарках. Модель уже доступна на Amazon Web Services, Google Cloud и Microsoft Azure.
Для чего нужна
Opus 5.5 рассчитан на сложные задачи, требующие взвешённых решений. Sonnet 5.5 нацелен на повседневную работу: исправление багов, написание документации, создание презентаций и таблиц. Anthropic также анонсировала Claude Haiku 5.5 на ближайшие недели — модель для сценариев с высокой пропускной способностью и низкой стоимостью.
Резкий скачок в кодинге
Наибольший прогресс Sonnet 5.5 показывает в программировании. На Terminal-Bench 4.0, тесте для агентного кодинга, модель набирает 70,6% против 10,3% у Sonnet 5. На CursorBench 4.0 результат — 55,5% против 34,1%, всего на два пункта ниже Opus 5.5 (57,8%).
На FrontierCode 1.1 в режиме High Sonnet 5.5 опережает Sonnet 5 на десять пунктов примерно при одной пятнадцатой стоимости за задачу. Ранние тестировщики отметили, как быстро модель разбирается в кодовой базе. Sonnet 5.5 также чаще группирует вызовы инструментов, что сокращает число шагов.
Есть и странность: на максимальном уровне усилий Max модель показывает на FrontierCode результат хуже, чем на Xhigh. Anthropic объясняет это тем, что при максимуме усилий модель чаще запускает функцию код-ревью, которая делит работу между субагентами. В некоторых случаях это приводило к таймаутам или изменениям за пределами задачи, а FrontierCode за такое снижает оценку.
Почти как Opus в работе со знаниями
На GDPval-AA, бенчмарке OpenAI для офисных задач из 44 профессий и девяти отраслей, Sonnet 5.5 набирает 1 844 балла. Это почти совпадает с Opus 5.5 (1 846) и примерно на 400 баллов выше Sonnet 5 (1 449). GPT-6 Sol по данным Anthropic получает 1 487 баллов. На Chartography, тесте распознавания визуальных диаграмм, Sonnet 5.5 прыгает с 15,6% до 61,6%.
Ранние тестировщики описали Sonnet 5.5 как более естественного собеседника с чувством дизайна. По утверждению Anthropic, модель умеет переделывать интерфейсы и выполнять шаблоны слайдов так, что результат почти не требует правок. Компания также заявляет, что Sonnet 5.5 — первая модель серии Sonnet, способная пройти Pokémon Red, используя только скриншоты.
Цена и защита
Цена за миллион токенов не изменилась по сравнению с Sonnet 5: $2 за входные, $10 за выходные и $0,20 за чтение кэша. Поскольку модель тратит меньше токенов на задачу, эффективные затраты падают до 30%. Независимое тестирование этих заявлений ещё предстоит.
Как и другие модели Anthropic, Sonnet 5.5 предлагает настраиваемый уровень усилий, позволяющий обменивать стоимость и скорость на качество. На низких и средних настройках модель уже обходит лучшие результаты Sonnet 5 на нескольких бенчмарках примерно при одной десятой стоимости за задачу. Подбор подходящего уровня под конкретную задачу пока остаётся скорее искусством, чем наукой.
Поскольку Sonnet 5.5 значительно сильнее предшественника в кибербезопасности, Anthropic впервые добавляет защитные механизмы в модель серии Sonnet. Запросы, связанные с высокорисковыми задачами в этой области, будут заметно перенаправляться на Sonnet 5. Через расширенную программу Cyber Verification Program квалифицированные специалисты смогут подать заявку на уровне доступа. Компания также добавила классификаторы против атак дистилляции — те же, что используются в самых мощных моделях. Насколько эти меры работают, станет ясно в ближайшие месяцы.
Для профиТехнические детали: архитектура, цифры, ссылки
Sonnet 5.5 доступна через Claude Platform под ID claude-sonnet-5-5 с нулевым хранением данных. Цены за миллион токенов: $2 входные, $10 выходные, $0,20 чтение кэша, $2,50 запись кэша. Для сравнения: Opus 5.5 — $4/$20, GPT-6 Sol — $2/$10, GPT-6 Luna — $0,10/$0,50.
Примечания: для Opus 5.5 на Terminal-Bench 4.0 указан лучший результат на настройке Xhigh. Sonnet 5.5 на FrontierCode показывает меньший результат на Max, чем на Xhigh. Значения Sonnet 5.5 на GDPval-AA и AA Briefcase получены на предрелизной версии, где исправленная позже ошибка могла влиять на структурированные выводы.
Вопросы и ответы
- Сколько стоит Claude Sonnet 5.5?
- Столько же, сколько Sonnet 5: $2 за миллион входных токенов, $10 за выходные и $0,20 за чтение кэша. Эффективная стоимость на задачу падает до 30% за счёт меньшего расхода токенов.
- Где доступна модель?
- На Amazon Web Services, Google Cloud и Microsoft Azure, а также через Claude Platform под ID claude-sonnet-5–5.
- Чем Sonnet 5.5 отличается от Opus 5.5?
- Opus 5.5 рассчитан на сложные задачи с высокими требованиями к качеству суждений, Sonnet 5.5 — на повседневную работу. На бенчмарках результаты близки, но Sonnet дешевле.



