Центральным элементом опубликованных материалов стала цитата из документа, написанного Брентом Хехтом, директором Microsoft по прикладным наукам. Хехт охарактеризовал практику обучения ИИ-моделей на миллионах статей, защищённых авторским правом, как «поразительную кражу беспрецедентных масштабов» и, возможно, «крупнейшую кражу труда в истории человечества». По его оценке, оправдание таких действий концепцией добросовестного использования («fair use») превращает эту правовую норму в «полную насмешку».
Microsoft отреагировала стандартным образом, заявив, что высказывания Хехта отражают «личное мнение сотрудника» и «не отражают позицию компании».
Помимо признания Хехта, в материалах приводятся и другие внутренние коммуникации, которые NYT использует для обоснования своих требований:
Внутренние документы OpenAI характеризуют ChatGPT как «современный газетный киоск», предоставляющий «быстрые, своевременные ответы», за которыми раньше приходилось обращаться к поисковикам.
Отдельно упоминается концепция «порочного круга» (doom loop): в документах Microsoft признаётся, что стратегия обучения ИИ на контенте СМИ подрывает экономические основы поставщиков этого контента, что в перспективе лишит сами ИИ-модели свежих данных для обучения.
NYT и другие истцы считают, что использование миллионов статей для обучения коммерческих ИИ-продуктов, которые затем конкурируют с оригинальными изданиями, не является добросовестным. Истцы ссылаются на данные Microsoft, согласно которым кликабельность ссылок на оригинальный контент среди пользователей ИИ-инструментов на 83–93% ниже, чем в традиционном поиске.
OpenAI и Microsoft настаивают, что обучение ИИ на доступных данных подпадает под доктрину добросовестного использования, а сам процесс представляет собой преобразование контента. Сатья Наделла, CEO Microsoft, в своих показаниях заявил, что если бы знал о парсинге контента за пейволлами, то потребовал бы переобучения моделей.
Microsoft вложила в партнёрство с OpenAI более 100 миллиардов долларов — эта цифра включает как первоначальные инвестиции, так и расходы на инфраструктуру и хостинг вычислений. По данным Bloomberg, компания изначально рассчитывала на возврат в 92 миллиарда долларов от своих ранних вложений.
Иск NYT, поданный в конце 2023 года, стал первым крупным иском американского медиа против разработчиков генеративного ИИ. К настоящему моменту к нему присоединились десятки других изданий и авторов, а общее число аналогичных дел в США превысило сорок.
Судья Сидни Стайн рассматривает ходатайство о вынесении решения в упрощённом порядке. Стороны могут подавать документы до середины ноября, после чего ожидается решение суда — вероятно, в начале 2027 года. В случае отказа в упрощённом производстве дело может дойти до полноценного суда с присяжными.