米国司法省は、AI時代で最も重要な著作権争いに自らの旗を掲げた。マンハッタンの連邦裁判所に提出された書面で、司法省は、著作権で保護された資料を用いて大規模言語モデルを訓練することは公正使用に該当すると主張し、これを制限することはアメリカの繁栄、経済的機会、国家安全保障を脅かす可能性があるとした。
この提出は、ニューヨーク・タイムズとOpenAI/マイクロソフトの統合訴訟に提出されたもので、この訴訟は2023年12月以降、裁判所で継続中である。これは、連邦政府がAI学習データを巡る広範な著作権紛争のいずれかに正式に介入した初の事例である。
政府の主張
司法省の核心的な主張は単純である:LLMがトレーニング中に著作権で保護されたテキストを取り込む際、それは意味のある競争的意味でそのテキストを複製しているわけではない。出力結果は元の作品を再現したり、代替したりしない。政府の説明では、このプロセスは「極めて変容的」であり、公正使用分析において実質的な重みを持つ法的専門用語である。
この要旨は、AIトレーニングのメカニズムを防衛する以上の内容を含んでいた。データへのアクセスを制限することは「科学および有用な芸術の進歩を著しく阻害する」と主張し、これは著作権法そのものの憲法的目的を意図的に想起させる表現である。
副司法長官のスタンリー・E・ワードワード・ジュニア、補助司法長官のブレット・シャムエイト、シニアカウンセルのマイケル・ワイスブッヒがすべてこの提出に貢献しており、これは中級職員のメモではないことを示している。
国家安全カード
司法省の主張の中で、おそらく最も政治的に敏感な要素は、AIのトレーニングを国家安全保障の問題として明示的に位置づけている点である。この書面は、米国が国内のAI産業を支配的地位に保つことに「深い国家的関心」を有し、過度に制限的な著作権の解釈が外国の敵対者に競争上の優位性をもたらす可能性があると主張している。
中国は明確な、ただし時として言及されない副次的な文脈だった。この議論は本質的に次のように要約される:アメリカのAI企業が高品質な英語データで学習できない場合、中国の対抗企業は同様の制約に直面しないため、米国は軍事的、経済的、地政学的に重要な技術競争で後れを取ることになる。
著作権とAIへの広範な影響
司法省の意見書は、ニューヨーク・タイムズの事件にのみ適用されるものではない。その論理は、訓練データの実践を巡ってAI企業を訴えた他の出版社、著者、クリエイターとの関連する著作権紛争にも及ぶ。政府が広範な公正使用の根拠を明確にすることで、数十件の未解決事件の結果に影響を与える法的枠組みを築いている。
重要な法的課題は未解決のままです:LLMのトレーニングの変革的性質は、著作権者への潜在的な市場への悪影響を上回るのでしょうか?裁判所はこれまで、公正使用のための四要素のバランステストを適用し、使用の目的と性質、著作権で保護された作品の性質、使用された数量、および原作の市場への影響を評価してきました。
司法省の立場は、最初の要因と四番目の要因に大きく依拠している。トレーニングは、元の素材を認識可能な形で再現しないため、変革的である。また、政府の説明によれば、LLMの出力は、そのトレーニングに使用された記事や書籍、創造的著作物と直接競合しない。しかし、出版業界は明らかにこの二番目の点に異議を唱え、AIが生成する要約や回答が、オリジナルのジャーナリズムや執筆の読者層を奪っていると主張する。
