Министерство юстиции США только что заявило о своей позиции в самом значимом споре об авторском праве эпохи ИИ. В документе, поданном в федеральный суд Манхэттена, Минюст утверждает, что обучение крупных языковых моделей на защищенных авторским правом материалах является добросовестным использованием, и что ограничение такой практики угрожает американскому процветанию, экономической мобильности и национальной безопасности.
Подача документа произошла в рамках объединенного иска между The New York Times и OpenAI/Microsoft — дела, которое рассматривается в судах с декабря 2023 года. Это первый случай, когда федеральное правительство официально вмешивается в одно из многочисленных споров, связанных с авторскими правами на данные для обучения ИИ.
Аргумент правительства
Основной аргумент Министерства юстиции прост: когда ИИ с большим объемом параметров поглощает авторски защищенный текст во время обучения, он не копирует этот текст в каком-либо значимом конкурентном смысле. Выходные данные не воспроизводят и не заменяют оригинальные произведения. В интерпретации правительства этот процесс является «исключительно трансформирующим» — юридический термин, имеющий реальное значение при анализе добросовестного использования.
Запрос шел дальше простой защиты механики обучения ИИ: он утверждал, что ограничение доступа к данным «серьезно затормозит прогресс науки и полезных искусств» — формулировка, намеренно отсылающая к конституционной цели авторского права.
Ассоциированный генеральный прокурор Стэнли Э. Вудвард-младший, помощник генерального прокурора Бретт Шумейт и старший советник Майкл Вайсбух внесли свой вклад в подачу документа, что свидетельствует о том, что это не было простым служебным сообщением среднего звена.
Карта национальной безопасности
Возможно, самым политически заряженным элементом аргумента Министерства юстиции является его явное представление обучения ИИ как вопроса национальной безопасности. В кратком изложении утверждается, что Соединенные Штаты имеют «глубокий национальный интерес» в поддержании доминирующей отечественной индустрии ИИ и что чрезмерно строгая интерпретация авторского права может передать конкурентные преимущества иностранным противникам.
Китай был очевидным, хотя и иногда неофициальным, подтекстом. Аргумент сводится к следующему: если американские компании в области ИИ не смогут обучать свои модели на высококачественных англоязычных данных, их китайские конкуренты не столкнутся с аналогичными ограничениями, и США отстанут в технологической гонке с огромными военными, экономическими и геополитическими последствиями.
Более широкие последствия для авторского права и ИИ
Краткое изложение DOJ применимо не только к делу NYT. Его аргументация распространяется на связанные споры об авторском праве, затрагивающие других издателей, авторов и создателей, подавших иски против компаний ИИ в связи с практиками использования данных для обучения. Формулируя широкое обоснование «добросовестного использования», правительство фактически создает юридический шаблон, который может повлиять на исход десятков ожидающих рассмотрения дел.
Ключевой правовой вопрос остается нерешенным: перевешивает ли трансформационный характер обучения ИИ с большими языковыми моделями потенциальный ущерб рынку правообладателям? Суды традиционно применяют четырехфакторный балансовый тест для определения добросовестного использования, оценивая цель и характер использования, характер защищенного авторским правом произведения, используемую сумму и влияние на рынок оригинала.
Позиция DOJ в значительной степени опирается на первый и четвертый факторы. Обучение является трансформационным, поскольку не воспроизводит исходный материал в узнаваемой форме. И выходные данные ИЯ не конкурируют напрямую со статьями, книгами или творческими произведениями, на которых они были обучены, по крайней мере, согласно представлению правительства. Издатели, очевидно, оспорят этот второй момент, утверждая, что генерируемые ИИ резюме и ответы действительно отвлекают аудиторию от оригинальной журналистики и писательства.
