Anthropic выпустила Opus 5.5: модель стала дешевле и превзошла Fable в ряде тестов
Новая версия Opus 5.5 получила улучшения в программировании и работе со знаниями, снизила стоимость выходных токенов с $25 до $20 за миллион и стала быстрее
Один основной источник · Как мы проверяем новости

Что произошло
Anthropic выпустила Opus 5.5, новую версию наиболее производительного уровня своей трёхуровневой линейки Claude. Sonnet занимает среднее положение в линейке, а Haiku является самой быстрой и дешёвой моделью.
Компания утверждает, что Opus 5.5 задаёт новый ориентир в программировании и работе со знаниями. По заявлению Anthropic, модель во многих тестах опередила более крупную Fable и выполнила несколько неформальных задач, с которыми Fable не справилась.
Что изменилось в модели
Выходные токены Opus 5.5 будут стоить $20 за миллион токенов против $25 у предыдущей версии. Anthropic также заявила о снижении вычислительных затрат на обслуживание модели, благодаря чему она работает быстрее.
В коммуникации модель стала реже использовать жаргон и чаще помещать важную информацию в начало сообщений.
Безопасность и следующие релизы
Релиз состоялся через два месяца после выхода Opus 5 24 июля. Anthropic сообщила, что Sonnet 5.5 и Haiku 5.5 выйдут в ближайшие недели и получат аналогичные улучшения производительности.
Компания считает возможности Opus 5.5 в биологии и кибербезопасности сопоставимыми с Mythos, поэтому распространила на модель те же меры безопасности, что и на Fable. Эти меры ограничивают использование моделей для поиска уязвимостей в скомпилированных программах и разработки распознаваемого биологического оружия.
Opus 5.5 стал первым релизом Anthropic после того, как генеральный директор Dario Amodei поддержал более осторожный темп развития передовых ИИ-возможностей. Обучение безопасности модели в целом соответствовало подходу к предыдущим версиям и включало проверки согласованности и предрелизную оценку со стороны METR и Frontier Design.
Почему это важно
Anthropic заявила, что уже готовит для будущих моделей более продвинутые системы обучения и оценки, включая улучшенные средства безопасности и мониторинга. Компания также считает, что по мере роста возможностей ИИ более значимую роль в обеспечении безопасности систем должна играть государственная политика.
Источники
Один основной источник. Как мы проверяем новости


