Дело OpenAI и Microsoft: подробности из суда
Недавно суд обнародовал закрытую переписку между OpenAI и Microsoft, касающуюся иска от The New York Times, поданного в 2023 году вместе с пятью авторами. Основной спор связан с тем, что компании обучали свою модель ChatGPT на миллионах новостных материалов, что вызвало серьезные опасения по поводу нарушения авторских прав и влияния на журналистику.
Судебные документы показывают, что OpenAI и Microsoft обходили платные ограничения (пейволы) и удаляли отметки об авторских правах из данных, используемых для обучения. В одном из внутренних отчетов Microsoft за 2023 год говорилось, что миллионы людей по всему миру могут воспринимать использование их труда искусственным интеллектом как воровство. Бренд Гехт, руководитель отдела прикладных наук Microsoft, охарактеризовал это как "самый масштабный акт присвоения чужой работы в истории человечества, способный запустить цепочку разрушительных последствий".
"Это представляет собой серьезную угрозу для издательств." - Ник Терли, OpenAI
Судьи отметили, что законодательная база, регулирующая обучение ИИ, пока находится в стадии развития. Рассматриваемое дело NYT является важным прецедентом для понимания, подпадает ли подобное обучение под понятие добросовестного использования. Между тем, Microsoft пытается дистанцироваться от высказываний своих сотрудников, заявляя, что их продукт Copilot "не заменяет работу журналистов", — отметил представитель компании Алекс Хаурек.
Последствия для медиа и журналистики
Внутренние материалы компании демонстрируют, что крупные языковые модели могут существенно вытеснить традиционную журналистику. Один из инженеров OpenAI признал: "Даже при явных ссылках пользователи вряд ли будут переходить по ним". Эта ситуация вызывает множество вопросов и вызывает напряжение в медиаотрасли.
Итоги этого судебного процесса могут стать определяющими для будущего применения искусственного интеллекта в сфере новостей, затрагивая важные темы авторских прав, этики и справедливости в использовании контента. В случае принятия новых правил, они смогут четко определить рамки добросовестного использования материалов для обучения моделей ИИ на базе уже существующих источников.
Для российского рынка это дело также актуально, поскольку вопросы защиты авторских прав и регулирования использования ИИ в медиа становятся все более значимыми в условиях цифровой трансформации и глобализации информации.
В условиях растущей обеспокоенности по поводу использования новостного контента в обучении ИИ, важно отметить, что Евросоюз уже классифицировал ChatGPT как один из крупных онлайн-поисковиков. Это решение может повлиять на будущие правила и стандарты в области авторских прав и использования данных. Узнайте больше о том, как это может сказаться на развитии технологий и журналистики в нашей статье по теме новых регуляций для ИИ.