Departmen Kehakiman AS baru sahaja menanam benderanya dalam pertempuran hak cipta paling berkesan di era AI. Dalam dokumen yang diajukan di mahkamah persekutuan Manhattan, DOJ berhujah bahawa melatih model bahasa besar menggunakan bahan yang dilindungi hak cipta dianggap sebagai penggunaan adil, dan bahawa sekiranya ia dibatasi, ia akan mengancam kemakmuran Amerika, mobiliti ekonomi, dan keselamatan negara.
Pengajuan tersebut masuk ke dalam tuntutan tergabung antara The New York Times dan OpenAI/Microsoft, sebuah kes yang telah berlarut-larut di mahkamah sejak Disember 2023. Ia menandakan kali pertama kerajaan persekutuan secara rasmi campur tangan dalam mana-mana daripada pertikaian hak cipta yang luas berkaitan data latihan AI.
Hujah kerajaan
Klaim utama DOJ adalah mudah: apabila LLM mengambil teks yang dilindungi hak cipta semasa latihan, ia tidak menyalin teks tersebut dalam sebarang erti yang bermakna dari segi persaingan. Outputnya tidak menghasilkan semula atau menggantikan karya asal. Dalam kerangka kerajaan, proses ini adalah “sangat transformasional”, istilah undang-undang yang membawa berat yang nyata dalam analisis penggunaan adil.
Permintaan tersebut melangkah lebih jauh daripada sekadar membela mekanisme latihan AI. Ia berhujah bahawa mengawal akses data akan “menghalang secara ketara kemajuan sains dan seni yang berguna,” bahasa yang sengaja meniru tujuan perlembagaan undang-undang hak cipta itu sendiri.
Penasihat Undang-undang Asosiasi Stanley E. Woodward Jr., Nasihat Undang-undang Asisten Brett Shumate, dan penasihat utama Michael Weisbuch semuanya menyumbang kepada failan tersebut, menandakan ini bukan sekadar memo staf peringkat pertengahan.
Kad keselamatan negara
Mungkin elemen paling bermuatan politik dalam hujah DOJ ialah penekanan eksplisitnya terhadap latihan AI sebagai isu keselamatan negara. Memorandum tersebut berpendapat bahawa Amerika Syarikat mempunyai “kepentingan nasional yang mendalam” dalam mengekalkan industri AI domestik yang dominan, dan bahawa tafsiran hak cipta yang terlalu ketat boleh memberikan kelebihan persaingan kepada pesaing asing.
China adalah konteks yang jelas, walaupun kadang-kadang tidak dinyatakan. Hujah pada dasarnya bermuara kepada: jika syarikat AI Amerika tidak boleh melatih data berbahasa Inggeris berkualiti tinggi, rakan sebaya China mereka tidak akan menghadapi sekatan serupa, dan AS akan tertinggal dalam perlumbaan teknologi dengan kepentingan ketenteraan, ekonomi, dan geopolitik yang besar.
Implikasi lebih luas terhadap hak cipta dan AI
Kertas kerja DOJ tidak hanya berlaku untuk kes NYT. Alasan ia memperluas kepada pertikaian hak cipta berkaitan yang melibatkan penerbit, penulis, dan pencipta lain yang telah menggugat syarikat AI mengenai amalan data latihan. Dengan merumuskan justifikasi penggunaan adil yang luas, kerajaan secara efektif menetapkan templat undang-undang yang boleh membentuk kesudahan lusinan kes yang sedang ditunggu.
Soalan undang-undang utama masih belum diselesaikan: adakah sifat transformasi latihan LLM mengatasi kesan pasaran yang berpotensi terhadap pemegang hak cipta? Mahkamah secara sejarah telah mengaplikasikan ujian penyeimbangan empat faktor untuk penggunaan adil, menimbang tujuan dan ciri penggunaan, sifat karya yang dilindungi hak cipta, jumlah yang digunakan, dan kesan terhadap pasaran untuk karya asal.
Kedudukan DOJ sangat bergantung kepada faktor pertama dan keempat. Latihan adalah transformasional kerana ia tidak membiarkan bahan sumber dipaparkan dalam bentuk yang boleh dikenali. Dan output LLM tidak bersaing secara langsung dengan artikel, buku, atau karya kreatif yang digunakan untuk melatihnya, sekurang-kurangnya menurut versi kerajaan. Penerbit jelas akan membantah titik kedua ini, berhujah bahawa ringkasan dan jawapan yang dihasilkan AI benar-benar merampas audiens untuk jurnalisme dan penulisan asal.
