openai

Аргумент OpenAI: 1 899 слов из «Игры престолов»

Promtime

openai

Authors Guild и 13 авторов-соистцов подали ходатайство об упрощённом решении по объединённому делу о копирайте против OpenAI и Microsoft, докет 1:25-md-03143 в Южном округе Нью-Йорка. Документ датирован 5 сентября, встречное ходатайство защиты поступило днём раньше, 4 сентября, и обе стороны просят судью Сидни Стайна разрешить спор без полноценного разбирательства.

В упрощённом производстве судья оценивает бесспорные доказательства и выносит решение, не доводя дело до полного процесса. Ход дела и содержание обоих ходатайств разбирает Publishers Weekly: публичные версии документов сильно отредактированы, из них вымараны данные о числе затронутых книг и о методах сбора обучающих наборов.

Коротко

  • Книжная часть спора рассматривается вместе с иском новостных организаций во главе с The New York Times: к октябрю 2025 года дела были объединены в один докет In Re: OpenAI Inc. Copyright Infringement Litigation.
  • По утверждению OpenAI, доля дословных совпадений составляет 0,00007%, а самый длинный отрывок, который эксперт истцов получил миллионами запросов, занял 1 899 слов, или 0,62% «Игры престолов»; защита считает это доказательством, что копии книг не выдаются.
  • Истцы связывают обучение моделей с потерей дохода от лицензий на использование книг в ИИ и ростом продаж сгенерированной прозы на площадках вроде Kindle, называя это угрозой рынку книг, написанных людьми.

Спор в Южном округе Нью-Йорка стал одним из ключевых для отрасли: исход ходатайств покажет, придётся ли разработчикам моделей платить за книжные корпуса или копирование ради обучения останется добросовестным использованием. Обе стороны опираются на прецеденты, и это выглядит как попытка зафиксировать правило до того, как лицензионные расходы станут отраслевой нормой. Для издателей на кону сама возможность рынка лицензий на данные.

Истцы называют фундаментом бизнеса OpenAI копирование книг с пиратского сайта Library Genesis

В ходатайстве от 5 сентября Authors Guild и авторы пишут, что модели GPT представляют экзистенциальную угрозу для тех, кто пишет и издаёт книги, и что OpenAI «построила фундамент своего бизнеса на массовом пиратстве». По их версии, книжный контент воспроизводился с пиратского ресурса Library Genesis, а затем удалялся.

Истцы ссылаются на практику судов, по которой получение «бесплатно» того, что обычно приходится покупать, не считается добросовестным использованием. Книги они называют высококачественными данными из-за организованного текста и структурированных мыслей: это, по их аргументу, и позволяет большим языковым моделям убедительно имитировать человеческое повествование и манеру речи.

В качестве доказательства ущерба профессии истцы указывают на рост продаж сгенерированной прозы, в том числе на устройствах Kindle, и цитируют вирусный твит специалиста OpenAI по машинному обучению Таруна Гогинени 2025 года: если Джордж Р. Р. Мартин «умрёт рано, GPT-5 допишет его серию».

OpenAI оценивает долю дословных совпадений в своих моделях в 0,00007%

В ходатайстве от 4 сентября защита утверждает, что использование было добросовестным, поскольку носило в высшей степени преобразующий характер, и что «ни одно право собственности не безгранично». Книги, по её объяснению, попали в выборку потому, что обучение полезной языковой модели требует от сотен миллиардов до десятков триллионов слов из разнородных источников.

OpenAI настаивает, что ChatGPT «не показывает копии» книг, а выдаваемое содержание не отличается от обычных цитат и пересказов, доступных в сети бесплатно. Дословные последовательности, по её данным, воспроизводятся в 0,00007% случаев и обычно сводятся к идиомам или текстам общественного достояния, таким как Геттисбергская речь.

Эксперт истцов, как пишет защита, миллионами промптов пытался заставить модели воспроизвести текст: самый длинный непрерывный фрагмент составил 1 899 слов из «Игры престолов», то есть 0,62% книги. Защита добавляет, что конкуренция со стороны новых, не нарушающих права произведений не относится к вреду, от которого защищает копирайт.

Защита ссылается на Google Books и Kadrey v. Meta, а истцы называют копирование непреобразующим

OpenAI сравнивает своё положение с делом Authors Guild v. Google Inc. 2015 года о Google Books и с делом Kadrey v. Meta Platforms 2025 года, где ответчики выиграли на аргументе о добросовестном использовании. Обучение моделей, по её доводу, служит иной цели, чем написание книг, применимо к множеству задач вне литературы и приносит общественную пользу.

Истцы отвечают, что копирование было непреобразующим: оно велось скрытно ради создания конкурирующего коммерческого продукта и лишило авторов и издателей возможности заработать на лицензиях для обучения ИИ. Потребность моделей в огромных объёмах данных, по их мнению, не оправдывает воспроизведение творческих текстов.

Иск Authors Guild и 17 соистцов был подан в сентябре 2023 года. Сейчас в числе ведущих соистцов 13 авторов, среди них Дэвид Балдаччи, Тейлор Бранч, Майкл Коннелли, Сильвия Дэй, Джонатан Франзен, Джон Гришэм, Джордж Р. Р. Мартин и Джоди Пиколт; семеро из них участвуют в деле с самого начала.

Возражения в октябре, ответы в ноябре

Возражения на ходатайства должны поступить в начале октября, ответные записки в начале ноября. Дата, когда судья Сидни Стайн вынесет решение, не называется, как и то, какая часть закрытых материалов будет раскрыта. Из публичной версии также вычеркнуто описание того, как, по версии истцов, OpenAI и Microsoft «работали вместе» при копировании защищённых текстов.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.