Anthropic, syarikat kecerdasan buatan yang mengembangkan chatbot Claude,menyatakan pada hari Jumaatserangkaian langkah keselamatan pemilu baru yang bertujuan untuk mencegah kecerdasan buatannya dimanfaatkan untuk menyebarkan maklumat palsu atau memanipulasi pengundi sebelum pilihan raya pertengahan penggal Amerika Syarikat 2026 dan pilihan raya besar lain di seluruh dunia tahun ini.
Syarikat yang beribu pejabat di San Francisco menerangkan pendekatan pelbagai sisi, termasuk sistem pengesanan automatik, ujian tekanan terhadap tindakan yang berkesan, dan kerjasama dengan organisasi sumber pengundi bebas—langkah-langkah ini mencerminkan tekanan yang semakin meningkat terhadap pembangun kecerdasan buatan untuk mengawal penggunaan alat mereka semasa musim pilihan raya.
Dasar penggunaan Anthropic melarang penggunaan Claude untuk aktiviti politik yang menipu, menghasilkan kandungan digital palsu yang bertujuan untuk mempengaruhi pendapat politik, melaksanakan penipuan pemilih, mengganggu infrastruktur pengundian, atau menyebarkan maklumat yang menyesatkan mengenai proses pengundian.
Untuk memastikan peraturan ini dilaksanakan, syarikat tersebut menyatakan bahawa mereka telah menjalani serangkaian ujian terhadap robot model terbaharu mereka. Anthropic menggunakan 600 permintaan—300 permintaan berbahaya dan 300 permintaan sah—untuk mengukur ketepatan respons Claude terhadap permintaan yang munasabah serta ketepatan penolakan terhadap permintaan yang tidak munasabah. Kadar respons yang betul bagi Claude Opus 4.7 dan Claude Sonnet 4.6 masing-masing ialah 100% dan 99.8%.
Perusahaan tersebut juga menguji keupayaan modelnya dalam menghadapi strategi manipulasi yang lebih kompleks. Melalui simulasi perbualan berbilang putaran yang mewakili pendekatan bertahap yang mungkin digunakan oleh pelaku jahat, Sonnet 4.6 dan Opus 4.7 masing-masing mencapai ketepatan 90% dan 94% dalam memberikan tindakan yang sesuai dalam skenario manipulasi pengaruh.
Anthropic juga menguji sama ada modelnya mampu melaksanakan tindakan pengaruh secara autonomi—merancang dan melaksanakan tindakan berperingkat sepenuhnya tanpa campur tangan manusia. Syarikat tersebut menyatakan bahawa, selepas mengambil langkah-langkah keselamatan, model terbaharu hampir menolak semua tugas.
Mengenai isu keberanian politik, syarikat melakukan penilaian sebelum setiap pelancaran model, untuk mengukur konsistensi dan keadilan Claude apabila menghadapi petunjuk daripada pelbagai spektrum politik. Skor Opus 4.7 dan Sonnet 4.6 masing-masing ialah 95% dan 96%.
Untuk pengguna yang mencari maklumat pengundian, Claude akan menunjukkan banner pilihan raya yang membimbing mereka ke TurboVote. TurboVote ialah platform sumber bukan parti yang dioperasikan oleh Democracy Works, yang menyediakan maklumat tepat dan semasa mengenai pendaftaran pengundi, tempat pengundian, tarikh pilihan raya, dan butiran ballot. Banner serupa juga dirancang untuk pilihan raya besar Brazil pada akhir tahun ini.
Anthropic mengatakan bahawa seiring berlalunya kitaran pilihan raya, syarikat itu merancang untuk terus memantau sistemnya dan memperbaiki langkah-langkah pertahanannya.DecryptKami telah menghubungi Anthropic untuk mendapatkan pandangan mengenai keputusan penyiasatan, tetapi belum menerima sebarang balasan.
