Минюст США поддержал OpenAI в иске New York Times о нарушении авторских прав

Минюст США поддержал OpenAI в иске New York Times о нарушении авторских прав

New York Times в конце 2023 года подала иск против OpenAI и Microsoft в федеральный суд Манхэттена, утверждая, что миллионы статей издания использовались без разрешения для обучения языковых моделей вроде GPT-4 и создания продуктов, конкурирующих с самой газетой как источником информации. NYT оценила ущерб в миллиарды долларов и потребовала уничтожить модели, обученные на её статьях. Дело считается показательным для того, как суды в целом будут решать вопрос об обучении ИИ на защищённых авторским правом материалах.

Министерство юстиции США подало в этом объединённом деле документ в поддержку позиции ИИ-компаний: по мнению ведомства, обучение моделей на таких текстах, добросовестное использование (fair use). Ключевой довод, юридическое различие между копированием текста для обучения и тем, что модель выдаёт на выходе: во время обучения копируются целые произведения, но они не публикуются, а результаты работы моделей «часто, если не всегда, лишены существенного сходства» с оригиналами. По мнению Минюста, теория рыночного вреда, которая не разделяет обучение и генерацию ответов, юридически ошибочна.

В документе Минюст приводит в пример писательницу Джоан Дидион: в юности она переписывала рассказы Хемингуэя, чтобы разобраться, как устроены его фразы. По логике решения по делу Kadrey, на которое ссылается ведомство, Дидион могла бы понести ответственность за всё, что публиковала позже. Минюст также ссылается на более раннее судебное решение, согласно которому было бы немыслимо требовать плату всякий раз, когда человек, опираясь на прочитанную книгу, пишет что-то новое по-своему. Ведомство настаивает, что языковые модели обладают творческой и общественной ценностью, «люди создают оригинальные произведения с помощью ИИ», а ответственность за само обучение ИИ подавила бы ту креативность, которую и должно защищать авторское право.

Издание отмечает, что все эти аргументы обходят стороной вопрос масштаба: одно дело, один автор, копирующий текст, чтобы научиться, и совсем другое, компания с оборотом в миллиарды долларов, превращающая тот же материал в конкурирующие продукты. Именно на этом настаивает Бюро регистрации авторских прав США (US Copyright Office) в докладе, который прямо отверг безусловное признание добросовестного использования при обучении ИИ: по мнению Бюро, ИИ делает точные копии и генерирует контент со скоростью и в масштабе, недостижимых для человека, а коммерческие приложения, конкурирующие с оригинальными произведениями на существующих рынках, выходят за рамки добросовестного использования.

В своём документе Минюст прямо оспаривает этот доклад: по мнению ведомства, оценка бывшей главы Бюро (Register of Copyrights) Ширы Перлмуттер не имеет обязательной юридической силы, а сам доклад проигнорировал прецедентное право о том, как оценивать дела по существу конкретных обстоятельств и какие виды рыночного вреда действительно учитываются по закону. «Вопрос о добросовестном использовании зависит от конкретных фактов и обстоятельств каждого дела. Но было бы проблематично, и юридически неверно, вводить широкую ответственность за нарушение авторских прав, которая в целом сделала бы обучение ИИ-моделей невозможным без лицензирования», пишет Минюст.

Перлмуттер была уволена администрацией Трампа вскоре после публикации доклада. Демократ Джо Морелл заявил, что её уволили за отказ узаконить обучение ИИ на защищённых авторским правом материалах, позицию, которую поддерживает союзник Трампа Илон Маск. В сноске к документу Минюст отмечает, что Перлмуттер сейчас оспаривает своё увольнение.

Ключевые факты

  • Минюст США подал процессуальный документ в поддержку OpenAI и Microsoft по объединённому иску New York Times, заявив, что обучение ИИ-моделей на защищённых авторским правом текстах, добросовестное использование.
  • NYT подала иск в конце 2023 года в федеральный суд Манхэттена, утверждая, что миллионы её статей без разрешения использовались для обучения моделей вроде GPT-4; издание оценило ущерб в миллиарды долларов и потребовало уничтожить обученные на его статьях модели.
  • Ключевой довод Минюста: копирование целых текстов при обучении и то, что модель выдаёт на выходе, разные вещи; результаты работы моделей «часто, если не всегда, лишены существенного сходства» с оригиналами.
  • Позиция Минюста расходится с более ранним докладом Бюро регистрации авторских прав США, которое отвергло безусловное признание добросовестного использования при обучении ИИ; экс-глава бюро Шира Перлмуттер была уволена администрацией Трампа вскоре после публикации доклада.
  • Минюст ссылается на пример Джоан Дидион, в юности переписывавшей рассказы Хемингуэя, чтобы освоить его стиль, по логике решения по делу Kadrey это могло бы обернуться для неё ответственностью.

Почему это важно

Позиция федерального министерства юстиции по ключевому вопросу, можно ли обучать ИИ-модели на чужих текстах без лицензии, способна повлиять на исход одного из самых заметных судебных процессов об авторском праве и ИИ и задать ориентир для похожих исков против ИИ-компаний. Дело New York Times против OpenAI и Microsoft считается показательным для того, как суды в целом будут решать вопрос об обучении ИИ на защищённых материалах.

Кому это важно

OpenAI, Microsoft и другие компании, разработчики ИИ, чьи модели обучены на больших массивах текста без прямых лицензий; издательства, СМИ и авторы, которые судятся или могут судиться за использование своих материалов при обучении; юристы и суды, рассматривающие похожие иски.

Как это применить

Прямого практического действия здесь нет, это позиция госоргана в чужом судебном процессе, а не решение суда или новый продукт. Но для компаний, разрабатывающих ИИ, и для правообладателей это сигнал: пока спор идёт, лицензионные переговоры и судебные риски вокруг обучающих данных остаются предметом активного разбирательства, а не решённым вопросом.

Можно ли доверять

Источник, издание The Decoder, которое напрямую цитирует поданный Минюстом документ и приводит формулировки из него. Важно понимать: это позиция одной из сторон в текущем судебном процессе, а не постановление суда, окончательного решения по делу пока нет.

Риски и подводные камни

Позиция Минюста прямо противоречит более раннему докладу Бюро регистрации авторских прав США, отвергавшему безусловное fair use для обучения ИИ; увольнение автора того доклада, Ширы Перлмуттер, вскоре после его публикации демократ Джо Морелл связал с её отказом узаконить обучение ИИ на защищённых материалах, позицией, которую поддерживает союзник Трампа Илон Маск. Это добавляет делу политическое измерение: позиция администрации может восприниматься как поддержка крупных ИИ-компаний в ущерб авторам и издателям, а сама Перлмуттер сейчас оспаривает своё увольнение.

«Вопрос о добросовестном использовании зависит от конкретных фактов и обстоятельств каждого дела. Но было бы проблематично, и юридически неверно, вводить широкую ответственность за нарушение авторских прав, которая в целом сделала бы обучение ИИ-моделей невозможным без лицензирования.»

— Минюст США