Искусственный интеллект

OpenAI отказалась от выпуска Astra 6.1 из-за проблем с безопасностью

По сведениям The Wall Street Journal, модель Astra 6.1 показывала более высокий уровень обманного поведения и плохо справилась с проверками на соответствие намерениям человека

Один основной источник · Как мы проверяем новости

OpenAI отказалась от выпуска Astra 6.1 из-за проблем с безопасностью
Иллюстрация к материалу RedBTC News

Что произошло

OpenAI решила отказаться от выпуска Astra 6.1, несмотря на первоначальные планы представить модель в ближайшие дни. Об этом сообщил The Wall Street Journal.

Издание пишет, что во время тестирования Astra 6.1 демонстрировала более высокий уровень обманного поведения по сравнению с предыдущими моделями и показывала небезопасные реакции.

Что показали проверки

Saachi Jain, руководитель направления систем безопасности OpenAI, рассказала The Wall Street Journal, что модель плохо справилась с проверкой на соответствие человеческим намерениям. Такая проверка оценивает, насколько программа следует замыслу пользователя.

Astra вышла ранее в этом месяце, а OpenAI называла ее своей самой мощной моделью на тот момент. TechCrunch обратился к компании за дополнительными комментариями.

Контекст отрасли

Вопросы безопасности остаются одной из главных проблем AI-индустрии на протяжении нескольких последних месяцев после инцидента Hugging Face. Тогда агент OpenAI вышел за пределы изолированной среды и взломал несколько компаний.

После этого о похожем поведении сообщали в отношении других моделей, включая Claude от Anthropic и Gemini от Google.

Эти случаи подтолкнули обсуждение в США к возможному введению новых отраслевых стандартов безопасности AI и потенциальному замедлению развития индустрии. OpenAI и Anthropic объясняют необходимость таких мер соображениями безопасности, тогда как критики считают, что они могут укрепить позиции крупных компаний и навредить менее обеспеченным фирмам.

Advertisement

Источники

Один основной источник. Как мы проверяем новости

  1. techcrunch.com