Anthropic выпустила Claude Sonnet 5.5: модель обошла Opus 5.5 в программировании
Claude Sonnet 5.5 получила результат 70,6% в Terminal-Bench 4.0 и стоит $2 за миллион входных токенов и $10 за миллион выходных. При максимальной настройке усилий модель расходует больше токенов, чем любая другая модель, измеренная Artificial Analysis
Один основной источник · Как мы проверяем новости

Что произошло
Anthropic выпустила Claude Sonnet 5.5 в понедельник. Модель стала обновлением Sonnet 5, представленной в июне, и, по заявлению компании, работает более чем на 30% быстрее предшественницы.
Anthropic позиционирует Sonnet 5.5 как модель для повседневных задач с четкими рамками, исправления ошибок, а также подготовки документов, презентаций и электронных таблиц. Компания также отмечает ее способности в дизайне.
Результаты тестов и стоимость
Цена Claude Sonnet 5.5 сохранилась на уровне $2 за миллион входных токенов и $10 за миллион выходных. Это вдвое меньше стоимости Opus 5.5. Anthropic также утверждает, что новая модель использует почти на треть меньше токенов на задачу и поэтому дешевле Sonnet 5 в эксплуатации.
В Terminal-Bench 4.0, где оценивается способность ИИ-агента самостоятельно выполнять сложные профессиональные задачи через команды, Sonnet 5.5 получила 70,6%. Opus 5.5 набрала 66,4%, а Sonnet 5 — 10,3%.
В собственной версии теста Artificial Analysis результат Sonnet 5.5 составил 63,6%, у Opus 5.5 — 59,6%, а у GPT-6 Astra от OpenAI — 59,1%.
На GDPval-AA, оценивающем профессиональную работу в 44 сферах с помощью рейтинга Elo, Sonnet 5.5 получила 1844 балла, а Opus 5.5 — 1846. Разница указывает на практически равный результат.
Почему это важно
Sonnet 5.5 показала более высокий результат в Terminal-Bench 4.0, несмотря на позиционирование как модель среднего уровня и более низкую цену по сравнению с Opus 5.5.
Итог зависит от настройки усилий: более длительное рассуждение может повысить качество ответа, но увеличивает расходы. Anthropic заявляет, что при высокой настройке Sonnet 5.5 сопоставима с GPT-6 Sol в FrontierCode примерно за пятую часть стоимости задачи.
При максимальной настройке Sonnet 5.5 создавала около 193 000 токенов на тестовую задачу — примерно на 60% больше, чем Opus 5.5. Artificial Analysis оценила стоимость такой задачи в $7,60, что примерно на 50% выше показателя Sonnet 5 и расходится с заявлением Anthropic об экономии до 30%.
Anthropic связывает экономию с более низкими настройками. В приложениях компании по умолчанию используется средняя настройка: по утверждению Anthropic, в этом режиме Sonnet 5.5 превосходит лучший результат Sonnet 5 в программировании менее чем за десятую часть стоимости. Artificial Analysis считает высокую настройку наиболее выгодной.
Конкуренция на рынке моделей
OpenAI на прошлой неделе снизила цену GPT-6 Sol до $2 и $10. Модель среднего уровня GPT-5.6 Terra стоит $2 за миллион входных токенов и $12 за миллион выходных. Anthropic не публиковала результаты Terra в указанных тестах.
Источники
Один основной источник. Как мы проверяем новости


