Ang Anthropic, ang artificial intelligence company na nag-develop ng chatbot na Claude,ay inanunsyo noong Fridayisang serye ng mga bagong pagsisikap para sa integridad ng eleksyon na naglalayong pigilan ang kanilang artificial intelligence na gamitin bilang armas upang magkalat ng maling impormasyon o manipulahin ang mga botante bago ang 2026 U.S. midterm elections at iba pang malalaking eleksyon sa buong mundo sa taong ito.
Ang kumpanyang may pangunahang tanggapan sa San Francisco ay detalyado ang isang maramihang pagkakataon, kabilang ang automated detection system, stress testing para sa epekto sa aksyon, at pakikipagtulungan sa mga organisasyon ng walang partido na mga botante—mga hakbang na nagpapakita ng patuloy na pagdami ng presyon sa mga developer ng artificial intelligence upang regulahin ang paggamit ng kanilang mga kasangkapan sa panahon ng eleksyon.
Ang mga patakaran sa paggamit ni Anthropic ay nagbabawal sa paggamit ng Claude para sa masasamang pampulitikang gawain, paglikha ng mga pekeng digital na nilalaman na layunin na影响 political opinion, pagpapalaganap ng voter fraud, pagbabanta sa infrastruktura ng boto, o pagpapalaganap ng maling impormasyon tungkol sa proseso ng boto.
Upang matiyak na isinasagawa ang mga patakaran na ito, inihayag ng kumpanya na sila ay nagpasa sa kanilang pinakabagong modelo ng robot sa isang serye ng pagsubok. Gumamit ang Anthropic ng 600 na prompt—300 na nakakasama at 300 na legal na hiling na pares—upang sukatin ang akurasye ng pagtugon ni Claude sa mga makatotohanang hiling at ang akurasye ng pagtanggi nito sa mga di-makatotohanang hiling. Ang rate ng tamang pagtugon ni Claude Opus 4.7 at Claude Sonnet 4.6 ay 100% at 99.8% ayon sa pagkakasunod-sunod.
Nilikha rin ng kumpanya ang kanyang modelo para sa mas kumplikadong mga estratehiya ng pagmamalabis. Sa pamamagitan ng pagpapakita ng maraming pagkakataon sa usapan, na nagpapakita ng mga hakbang-hakbang na paraan na maaaring gamitin ng mga masama, ang Sonnet 4.6 at Opus 4.7 ay nakamit ang 90% at 94% na tumpak na pagtugon sa mga sitwasyon ng pagpapalaganap ng impluwensya.
Inilunsad din ng Anthropic ang pagsubok kung kaya ng kanilang modelo na mag-execute ng mga aksyon na may impluwensya nang walang tulong ng tao—mula sa pagplano hanggang sa pagpapatupad ng mga multi-step na aksyon. Sinabi ng kumpanya na, pagkatapos ng pagpapatupad ng mga pagsasiguro, halos lahat ng mga gawain ay tinanggihan ng kanilang pinakabagong modelo.
Tungkol sa isyu ng politikal na neutrong pagkakaroon, sinusuri ng kumpanya ang bawat modelo bago ito ilunsad upang masukat ang pagkakatulad at katarungan ni Claude sa pagharap sa mga prompt na naglalaman ng mga pananaw mula sa iba’t ibang panig ng politikal na spektrum. Ang mga marka para sa Opus 4.7 at Sonnet 4.6 ay 95% at 96% ayon sa pagkakasunod-sunod.
Para sa mga user na naghahanap ng impormasyon tungkol sa boto, ipapakita ni Claude ang isang banner ng eleksyon na maglalayong magdala sa kanila sa TurboVote. Ang TurboVote ay isang partidong walang paliwanag na platform na pinapatakbo ng Democracy Works na nagbibigay ng maaasahang real-time na impormasyon tungkol sa pagpaparehistro bilang botante, mga lokasyon ng pagboto, mga petsa ng eleksyon, at detalye ng boto. Inirerehistro rin ang katulad na banner para sa pambansang eleksyon sa Brazil sa huli ng taon.
Ang Anthropic ay nagsabing habang lumalakas ang electoral cycle, planong patuloy nilang masubaybayan ang kanilang mga sistema at palawakin ang kanilang mga pagsisikap sa pagtatanggol.DecryptNa-contact na namin ang Anthropic upang humingi ng kanilang opinyon tungkol sa mga resulta ng imbestigasyon, ngunit wala pa ring tugon.
