В Microsoft обсуждали риски обучения AI-моделей на чужом контенте
Раскрытые материалы по иску The Times против OpenAI и Microsoft содержат предупреждения о том, что генеративный AI может подменять труд авторов и разрушать собственную цепочку поставок
Один основной источник · Как мы проверяем новости

Что произошло
В суде по иску The Times против OpenAI и Microsoft начали раскрывать документы. Дело было подано в конце 2023 года, а позднее к нему присоединились еще одиннадцать издателей.
Judge Sidney Stein из Южного округа Нью-Йорка рассматривает ходатайства о вынесении решения без полноценного разбирательства. По мере рассмотрения документы становятся публичными.
Что содержали внутренние документы
В одной из записок Microsoft за 2023 год говорилось, что миллионы людей могут воспринять поглощение их работы крупными моделями как кражу беспрецедентного масштаба. Автор также написал, что крупные AI-модели разрушают собственную цепочку поставок.
Microsoft заявила, что записки написал Brent Hecht, директор по прикладным исследованиям, который также занимал должность в Northwestern University. По версии компании, он не принимал решений, а его задачей было представлять противоположные и нестандартные точки зрения.
Позиции руководителей и сотрудников
Satya Nadella на слушаниях сказал, что любой контент за платным доступом должен лицензироваться теми, кто хочет его использовать. Он добавил, что при знании об обучении OpenAI на таком контенте воспользовался бы правом Microsoft потребовать переобучения моделей. Представитель уточнил, что Nadella говорил об общих принципах поиска и потребления информации.
Инженер OpenAI в феврале 2023 года написал, что пользователи не будут переходить по ссылкам, независимо от того, насколько заметно их показывать. Это противоречит аргументу о том, что чат-боты возвращают издателям трафик.
В записке за 2020 год Jack Clark предупреждал, что компания создает системы, заменяющие труд людей, формирующих культуру общества. Позднее он ушел из OpenAI и стал сооснователем Anthropic.
Почему это важно
Спор затрагивает использование журналистских материалов для обучения AI-моделей и вопрос о том, дополняют ли такие модели работу издателей или заменяют ее.
OpenAI оспаривает претензии, а Microsoft и OpenAI считают обучение добросовестным использованием. Представитель истцов заявил, что раскрытые документы показывают отношение компаний к справедливости их поведения.
Источники
Один основной источник. Как мы проверяем новости


