Искусственный интеллект

xAI выпустила Grok 4.7: модель стала крупнее, но не обошла лидеров

Grok 4.7 получил 2,1 трлн параметров, доступен без листа ожидания и обучался на дополнительных данных SpaceX. Однако в опубликованных тестах модель уступает Fable 5.1 и остается ниже лидеров рынка

Один основной источник · Как мы проверяем новости

xAI выпустила Grok 4.7: модель стала крупнее, но не обошла лидеров
Иллюстрация к материалу RedBTC News

Что произошло

xAI выпустила Grok 4.7 после нескольких предполагаемых задержек. Илон Маск как минимум пять раз переносил заявленные сроки с конца июля: от «четырех недель» и «нескольких недель» до «3–4 недель», «10 дней» и еще нескольких дней на доработку.

По словам xAI, новая модель дольше обрабатывает сложные задачи, чаще перепроверяет собственные ответы по сравнению с Grok 4.6 и получила самые сильные защитные механизмы компании на данный момент.

Характеристики и доступность

Grok 4.7 получил 2,1 трлн параметров — на 40% больше, чем Grok 4.6 с 1,5 трлн параметров. Цена использования составляет $2 за миллион входных токенов и $6 за миллион выходных токенов.

В обучении использовались дополнительные данные SpaceX: телеметрия спутников Starlink, производственные записи и журналы инженерных отказов. В xAI рассчитывают, что это поможет модели лучше рассуждать об аппаратном обеспечении и физических системах, чем моделям, обученным только на интернет-текстах.

Модель уже доступна в приложении Grok, Cursor, Grok Build и через API xAI. Маск назвал ее сочетанием интеллекта, скорости и низкой стоимости.

Что показывают тесты

Результаты тестов не подтверждают лидерство Grok 4.7. GDPval оценивает работу с юридическими записками, таблицами и презентациями по рейтингу Эло, используя задания, проверенные специалистами соответствующих областей.

В AA-Briefcase от Artificial Analysis, где проверяется многочасовая офисная работа с исследованием, анализом и подготовкой документов, Grok 4.7 получила 1657 баллов против 1678 у Fable 5.1.

В CursorBench 4.0, тестирующем реальные задачи программирования в редакторе Cursor, Grok 4.7 заняла промежуточную позицию. По стоимости выполнения задач она уступила GPT-6 Astra и Claude Sonnet 5, а Fable 5.1 опередила ее при любом уровне цены на графике.

Контекст

Для xAI отставание от лидеров стало продолжением предыдущей тенденции. Grok 4.5, представленный в июле, получил крупнейший в отрасли обучающий кластер, но занял третье место после моделей Claude и OpenAI. Grok 4.20 сделал акцент на скорости и характере ответов в ущерб надежности, а Grok 4.6 отставал от лидеров в автономном программировании.

Несмотря на результаты тестов, Grok 4.7 остается продуктом для миллионов пользователей, которые общаются с ним через X, отдельное приложение или приборную панель Tesla. Однако собственные тесты производителя помещают модель на ступень ниже ведущих систем.

Advertisement

Источники

Один основной источник. Как мы проверяем новости

  1. decrypt.co