Искусственный интеллект

Anthropic выпустила Opus 5.5: модель стала дешевле и превзошла Fable в ряде тестов

Новая версия Opus 5.5 получила улучшения в программировании и работе со знаниями, снизила стоимость выходных токенов с $25 до $20 за миллион и стала быстрее

Один основной источник · Как мы проверяем новости

Anthropic выпустила Opus 5.5: модель стала дешевле и превзошла Fable в ряде тестов
Иллюстрация к материалу RedBTC News

Что произошло

Anthropic выпустила Opus 5.5, новую версию наиболее производительного уровня своей трёхуровневой линейки Claude. Sonnet занимает среднее положение в линейке, а Haiku является самой быстрой и дешёвой моделью.

Компания утверждает, что Opus 5.5 задаёт новый ориентир в программировании и работе со знаниями. По заявлению Anthropic, модель во многих тестах опередила более крупную Fable и выполнила несколько неформальных задач, с которыми Fable не справилась.

Что изменилось в модели

Выходные токены Opus 5.5 будут стоить $20 за миллион токенов против $25 у предыдущей версии. Anthropic также заявила о снижении вычислительных затрат на обслуживание модели, благодаря чему она работает быстрее.

В коммуникации модель стала реже использовать жаргон и чаще помещать важную информацию в начало сообщений.

Безопасность и следующие релизы

Релиз состоялся через два месяца после выхода Opus 5 24 июля. Anthropic сообщила, что Sonnet 5.5 и Haiku 5.5 выйдут в ближайшие недели и получат аналогичные улучшения производительности.

Компания считает возможности Opus 5.5 в биологии и кибербезопасности сопоставимыми с Mythos, поэтому распространила на модель те же меры безопасности, что и на Fable. Эти меры ограничивают использование моделей для поиска уязвимостей в скомпилированных программах и разработки распознаваемого биологического оружия.

Opus 5.5 стал первым релизом Anthropic после того, как генеральный директор Dario Amodei поддержал более осторожный темп развития передовых ИИ-возможностей. Обучение безопасности модели в целом соответствовало подходу к предыдущим версиям и включало проверки согласованности и предрелизную оценку со стороны METR и Frontier Design.

Почему это важно

Anthropic заявила, что уже готовит для будущих моделей более продвинутые системы обучения и оценки, включая улучшенные средства безопасности и мониторинга. Компания также считает, что по мере роста возможностей ИИ более значимую роль в обеспечении безопасности систем должна играть государственная политика.

Advertisement

Источники

Один основной источник. Как мы проверяем новости

  1. techcrunch.com