Рассекреченные судебные документы показали, что руководители Microsoft и OpenAI внутри компаний обсуждали обучение ИИ на новостных материалах куда жёстче, чем публично. Об этом сообщило издание The New York Times, чей иск и стал причиной раскрытия переписки.
Директор по прикладной науке Microsoft, доктор Брент Хехт, сравнил работу OpenAI с "крупнейшей кражей труда в истории человечества", которая способна запустить "петлю обречённости". Топ-менеджер OpenAI Ник Терли в свою очередь описал происходящее как "экзистенциальную угрозу для издателей".
Материалы стали доступны в рамках иска, поданного The New York Times против OpenAI и Microsoft ещё в 2023 году. В публичный доступ попали только отдельные фрагменты переписки, без сопровождающего контекста.
Помимо цитат, документы описывают и техническую сторону сбора данных. По версии издания, OpenAI и партнёры обходили платные подписки на сайтах, формировали обучающие выборки из миллионов документов и удаляли из них уведомления об авторских правах.
Несколько похожих разбирательств уже завершились в пользу ИИ-компаний, однако судьи прямо указывали, что такие решения связаны с отсутствием сформированной правовой базы вокруг генеративных моделей.
Иск The New York Times считается ключевым для определения того, попадает ли обучение нейросетей под доктрину "добросовестного использования", которая разрешает работать с защищённым контентом без разрешения, например, в пародии или журналистике.
Microsoft при этом дистанцировалась от высказываний собственных сотрудников:
Позиция Microsoft изложена в её судебных документах, где объясняется, почему эти преобразующие виды использования соответствуют закону об авторском праве и почему Copilot не заменяет журналистику издателей.
Остальные фрагменты звучат менее эффектно, но не менее показательно. Когда сотрудник написал президенту OpenAI Грегу Брокману о новом способе обхода пейволла, тот, судя по документам, ответил "а, отлично".
Во внутреннем документе Microsoft от 2023 года говорилось, что "миллионы людей по всему миру скоро сочтут, что большие модели, "высасывающие" всю их работу, совершают поразительную кражу беспрецедентных масштабов".
Отдельно руководители обсуждали риски для самой новостной индустрии. Хехт охарактеризовал крупные модели как "продукт, который уничтожает собственную цепочку поставок", а инженер OpenAI ещё в 2023 году писал коллегам, что "неважно, насколько заметно мы показываем ссылки, пользователи по ним не кликнут".
Терли подтвердил это, назвав ИИ-продукты "в значительной степени замещающими" по отношению к журналистике.
Источник новости: shazoo.ru

