Американские издатели подали иск к Microsoft и OpenAI из-за обучения ИИ

Группа американских медиакомпаний подала иск против Microsoft и OpenAI, обвинив их в незаконном использовании журналистских материалов для обучения моделей искусственного интеллекта. В число истцов вошли Emmerich Newspapers, Ojai Media, Coopwood Publishing, Coopwood Magazine, Coopwood Media Group и Coopwood Newspapers.
По утверждению издателей, технологические компании использовали десятки тысяч статей без разрешения и выплаты компенсации. Истцы считают, что материалы применялись для создания коммерческих продуктов на основе ИИ, хотя права на публикации принадлежат медиакомпаниям.
Обвинения в обходе пейволлов и удалении данных об авторстве
В иске говорится, что при сборе данных OpenAI и Microsoft обходили платный доступ к публикациям. Истцы также заявили, что их контент содержал встроенную информацию об управлении авторскими правами: названия материалов, уведомления о copyright и условия использования.
Такие сведения позволяют определить правообладателя и правила работы с публикацией. Однако, по версии медиакомпаний, ответчики удаляли эти данные перед включением материалов в наборы для обучения больших языковых моделей.
Издатели утверждают, что на протяжении нескольких лет их статьи неоднократно воспроизводились почти дословно. Они назвали действия Microsoft и OpenAI угрозой для местной журналистики и заявили, что компании фактически не компенсируют использование контента, одновременно защищая собственные модели, код и системы лицензиями и платным доступом.
Продолжающийся спор об авторских правах
Это не первый иск к Microsoft и OpenAI из-за использования защищённых материалов при обучении языковых моделей. В конце 2023 года аналогичный процесс начала The New York Times. На момент подачи нового иска это разбирательство продолжалось.
Истцы считают, что действия технологических компаний нарушают американский Закон об авторском праве и Закон об авторском праве в цифровую эпоху. При этом OpenAI недавно сама выступала против кампаний по дистилляции своих языковых моделей, то есть переноса возможностей одной модели в другую с помощью специально подготовленных запросов и ответов.
Медиакомпании требуют компенсацию и возмещение убытков. Кроме того, они добиваются судебного запрета, который должен обязать ответчиков удалить из наборов данных все произведения, защищённые авторским правом.


