Anthropic выпустила Claude Sonnet 5.5: нейросеть работает на треть быстрее и дышит в спину флагману Opus

Компания Anthropic представила Claude Sonnet 5.5 — новую модель среднего уровня в актуальной линейке алгоритмов. Релиз получился необычным: вместо того чтобы просто снизить цены на API, разработчики сделали ставку на внутреннюю оптимизацию. Модель стала генерировать ответы на 30% быстрее предшественницы Sonnet 5, а по качеству программирования и работы с агентами вплотную приблизилась к флагманской Opus 5.5.
Формально тарифы на использование Sonnet 5.5 остались прежними: 2 доллара за миллион входных токенов и 10 долларов за миллион выходных. Для сравнения, запросы к мощной Opus 5.5 стоят ровно в два раза дороже. Однако, как отмечает VentureBeat, реальная стоимость выполнения комплексных задач снизилась примерно на 30%. Экономия достигается за счет поумневшей архитектуры: нейросеть реже ошибается, использует меньше токенов на рассуждения и реже дергает внешние инструменты для получения правильного ответа.
Агентное программирование и конкуренция с GPT-6 Sol
Наибольший скачок производительности произошел в написании кода и выполнении автономных команд. В профильном агентном тесте Terminal-Bench 4.0 новая модель показала 70,6% успешных действий, разгромив не только прошлую Sonnet 5 (10,3%), но и флагманскую Opus 5.5 (66,4%).
В задачах для профессиональной работы разрыв между средним и старшим классом также почти стерся. По данным издания The Decoder, в тестировании GDPval-AA новинка набрала 1844 балла, уступив Opus 5.5 всего два очка.
На фоне таких результатов в сообществе разработчиков начали называть Sonnet 5.5 «убийцей» недавно вышедшей GPT-6 Sol от OpenAI. Однако это преувеличение. Алгоритм Anthropic действительно превосходит конкурента в ряде метрик (например, в том же GDPval-AA счет 1844 против 1487 у Sol), но в тесте FrontierCode при максимальных затратах на рассуждение (reasoning effort) GPT-6 Sol все еще впереди с результатом 49,3% против 46,2%. Модели идут на равных, поочередно выигрывая в разных сценариях использования.
Экосистема и контекстное окно на миллион токенов

Сама Anthropic позиционирует Sonnet 5.5 как рабочую лошадку для повседневного кодинга, рефакторинга, анализа документов и таблиц. Самые сложные задачи с высокой степенью неопределенности по-прежнему рекомендуют делегировать тяжеловесной Opus 5.5.
Модель уже доступна в веб-интерфейсе Claude и по API. Партнеры компании также оперативно интегрировали новинку: в документации Google Cloud указано, что Sonnet 5.5 поддерживает массивное контекстное окно до 1 миллиона токенов и способна выдавать до 128 тысяч токенов за один ответ. В день релиза модель также стала доступна пользователям платных тарифов GitHub Copilot.
Sonnet 5.5 стала второй нейросетью актуального поколения Anthropic — флагман Opus 5.5 вышел неделей ранее, 22 сентября. Следующим шагом компании станет релиз облегченной Claude Haiku 5.5, ориентированной на быструю обработку массовых запросов.