Departemen Kehakiman AS baru saja menanamkan benderanya dalam pertempuran hak cipta paling berdampak di era AI. Dalam dokumen yang diajukan di pengadilan federal Manhattan, DOJ berargumen bahwa pelatihan model bahasa besar pada materi yang dilindungi hak cipta termasuk dalam penggunaan wajar, dan bahwa pembatasan terhadapnya akan mengancam kemakmuran Amerika, mobilitas ekonomi, dan keamanan nasional.
Pengajuan ini masuk ke dalam gugatan terpadu antara The New York Times dan OpenAI/Microsoft, sebuah kasus yang telah berlangsung di pengadilan sejak Desember 2023. Ini menandai pertama kalinya pemerintah federal secara resmi ikut campur dalam salah satu dari berbagai sengketa hak cipta yang berkaitan dengan data pelatihan AI.
Argumen pemerintah
Klaim inti DOJ sederhana: ketika LLM mengonsumsi teks berhak cipta selama pelatihan, ia tidak menyalin teks tersebut dalam arti kompetitif yang bermakna. Outputnya tidak mereproduksi atau menggantikan karya aslinya. Dalam kerangka pemerintah, proses ini bersifat “sangat transformasional,” istilah hukum yang memiliki bobot nyata dalam analisis penggunaan wajar.
Permintaan tersebut melangkah lebih jauh daripada sekadar membela mekanisme pelatihan AI. Argumennya menyatakan bahwa membatasi akses terhadap data akan “secara signifikan menghambat kemajuan ilmu pengetahuan dan seni yang bermanfaat,” bahasa yang sengaja menggema tujuan konstitusional hukum hak cipta itu sendiri.
Associate Attorney General Stanley E. Woodward Jr., Assistant Attorney General Brett Shumate, dan senior counsel Michael Weisbuch semua berkontribusi pada pengajuan ini, menandakan bahwa ini bukan semacam memo staf tingkat menengah.
Kartu keamanan nasional
Mungkin elemen paling bermuatan politis dari argumen DOJ adalah kerangka eksplisitnya yang menjadikan pelatihan AI sebagai isu keamanan nasional. Memorandum tersebut berpendapat bahwa Amerika Serikat memiliki "kepentingan nasional yang mendalam" dalam mempertahankan industri AI domestik yang dominan, dan bahwa interpretasi hak cipta yang terlalu ketat dapat memberikan keunggulan kompetitif kepada lawan asing.
China adalah subteks yang jelas, meskipun terkadang tidak disebutkan secara eksplisit. Argumen pada dasarnya berintikan: jika perusahaan AI Amerika tidak dapat melatih model mereka dengan data berbahasa Inggris berkualitas tinggi, rekan-rekan Tiongkok mereka tidak akan menghadapi kendala serupa, dan AS akan tertinggal dalam perlombaan teknologi dengan risiko militer, ekonomi, dan geopolitik yang sangat besar.
Dampak lebih luas terhadap hak cipta dan AI
Surat singkat DOJ tidak hanya berlaku untuk kasus NYT. Alasan tersebut berlaku untuk sengketa hak cipta terkait yang melibatkan penerbit, penulis, dan pencipta lain yang menggugat perusahaan AI terkait praktik data pelatihan. Dengan menyampaikan justifikasi luas mengenai penggunaan wajar, pemerintah secara efektif menetapkan kerangka hukum yang dapat membentuk hasil lusinan kasus yang sedang ditangani.
Pertanyaan hukum utama tetap belum terpecahkan: apakah sifat transformasional dari pelatihan LLM mengungguli potensi kerugian pasar terhadap pemegang hak cipta? Pengadilan secara historis menerapkan uji keseimbangan empat faktor untuk penggunaan wajar, dengan mempertimbangkan tujuan dan karakter penggunaan, sifat karya yang dilindungi hak cipta, jumlah yang digunakan, dan dampaknya terhadap pasar untuk karya asli.
Posisi DOJ sangat bergantung pada faktor pertama dan keempat. Pelatihan bersifat transformasional karena tidak mereproduksi materi sumber dalam bentuk yang dapat dikenali. Dan output LLM tidak bersaing langsung dengan artikel, buku, atau karya kreatif yang menjadi bahan pelatihannya, setidaknya menurut versi pemerintah. Penerbit jelas akan membantah poin kedua ini, berargumen bahwa ringkasan dan jawaban yang dihasilkan AI memang merampas audiens dari jurnalisme dan tulisan orisinal.
