Обнародованы документы Microsoft, раскрывающие масштаб нарушений авторских прав The New York Times со стороны OpenAI

Обнародованы документы Microsoft, раскрывающие масштаб нарушений авторских прав The New York Times со стороны OpenAI
Фото: magnific.com
Федеральный суд Манхэттена опубликовал расширенную версию материалов по иску издания The New York Times против OpenAI и Microsoft о нарушении авторских прав. Документы, поданные в рамках ходатайства о вынесении упрощённого решения, содержат цитаты из внутренней переписки и служебных записок руководителей обеих технологических компаний, которые признают масштаб использования защищённого авторским правом контента и его последствия для медиаиндустрии.

Центральным элементом опубликованных материалов стала цитата из документа, написанного Брентом Хехтом, директором Microsoft по прикладным наукам. Хехт охарактеризовал практику обучения ИИ-моделей на миллионах статей, защищённых авторским правом, как «поразительную кражу беспрецедентных масштабов» и, возможно, «крупнейшую кражу труда в истории человечества». По его оценке, оправдание таких действий концепцией добросовестного использования («fair use») превращает эту правовую норму в «полную насмешку».

Microsoft отреагировала стандартным образом, заявив, что высказывания Хехта отражают «личное мнение сотрудника» и «не отражают позицию компании».

Помимо признания Хехта, в материалах приводятся и другие внутренние коммуникации, которые NYT использует для обоснования своих требований:

  • Грег Брокман, президент OpenAI, согласно документам, обсуждал «взлом для обхода пейволла NYT» и, как утверждается, ответил «А, отлично» на предложение такой возможности.
  • Ник Тёрли, старший руководитель OpenAI, написал, что продукты компании «в значительной степени замещают» традиционные источники информации.
  • Джек Кларк, директор по политике OpenAI, отметил, что работа компании «будет всё больше приводить к созданию систем, замещающих труд людей, определяющих „культуру“ общества».

Внутренние документы OpenAI характеризуют ChatGPT как «современный газетный киоск», предоставляющий «быстрые, своевременные ответы», за которыми раньше приходилось обращаться к поисковикам.

Отдельно упоминается концепция «порочного круга» (doom loop): в документах Microsoft признаётся, что стратегия обучения ИИ на контенте СМИ подрывает экономические основы поставщиков этого контента, что в перспективе лишит сами ИИ-модели свежих данных для обучения.

NYT и другие истцы считают, что использование миллионов статей для обучения коммерческих ИИ-продуктов, которые затем конкурируют с оригинальными изданиями, не является добросовестным. Истцы ссылаются на данные Microsoft, согласно которым кликабельность ссылок на оригинальный контент среди пользователей ИИ-инструментов на 83–93% ниже, чем в традиционном поиске.

OpenAI и Microsoft настаивают, что обучение ИИ на доступных данных подпадает под доктрину добросовестного использования, а сам процесс представляет собой преобразование контента. Сатья Наделла, CEO Microsoft, в своих показаниях заявил, что если бы знал о парсинге контента за пейволлами, то потребовал бы переобучения моделей.

Microsoft вложила в партнёрство с OpenAI более 100 миллиардов долларов — эта цифра включает как первоначальные инвестиции, так и расходы на инфраструктуру и хостинг вычислений. По данным Bloomberg, компания изначально рассчитывала на возврат в 92 миллиарда долларов от своих ранних вложений.

Иск NYT, поданный в конце 2023 года, стал первым крупным иском американского медиа против разработчиков генеративного ИИ. К настоящему моменту к нему присоединились десятки других изданий и авторов, а общее число аналогичных дел в США превысило сорок.

Судья Сидни Стайн рассматривает ходатайство о вынесении решения в упрощённом порядке. Стороны могут подавать документы до середины ноября, после чего ожидается решение суда — вероятно, в начале 2027 года. В случае отказа в упрощённом производстве дело может дойти до полноценного суда с присяжными.

Автор: Александр Абрамов.

Тематики: Маркетинг

Ключевые слова: Microsoft, авторское право, Искусственный интеллект