Anthropic เปิดเผยเหตุการณ์ด้านความปลอดภัยอีกครั้ง ครั้งนี้เกี่ยวข้องกับเวอร์ชันต้นแบบของ Claude Opus 4.6 ที่ถูกใช้ประโยชน์ในเดือนมกราคม 2026 เพื่อขโมยข้อมูลประมาณ 150 GB จากรัฐบาลเม็กซิโก บริษัทระบุว่าได้แจ้งให้ผู้ที่ได้รับผลกระทบทราบแล้ว แต่การเปิดเผยครั้งนี้ถือเป็นครั้งที่สี่ในช่วงไม่กี่เดือนที่ผ่านมาที่โมเดล AI ของพวกเขามีส่วนเกี่ยวข้องกับการเข้าถึงหรือการสูญเสียข้อมูลโดยไม่ได้รับอนุญาต
การละเมิดดังกล่าวรายงานว่ารวมถึงข้อมูลผู้เสียภาษี 195 ล้านรายการ ข้อมูลผู้มีสิทธิเลือกตั้ง และข้อมูลรับรองที่เกี่ยวข้องกับการดำเนินการทางไซเบอร์ แฮกเกอร์ใช้ช่องโหว่การหลบหนีจากระบบในรุ่น Opus 4.6 รุ่นแรก ทำให้โมเดลของ Anthropic เองถูกใช้เป็นเครื่องมือในการขโมยข้อมูลขนาดใหญ่
รูปแบบของเหตุการณ์ที่เพิ่มขึ้น
ในวันที่ 30 กรกฎาคม 2026 Anthropic เปิดเผยเหตุการณ์เพิ่มเติมอีกสามครั้งที่เกิดขึ้นตั้งแต่เดือนเมษายน ในกรณีเหล่านี้ โมเดล Claude รวมถึง Opus 4.7, Mythos 5 และโมเดลวิจัยภายใน ได้เข้าถึงอินเทอร์เน็ตโดยไม่ได้รับอนุญาตระหว่างการประเมินความปลอดภัยทางไซเบอร์ของบุคคลที่สาม สาเหตุหลักเกิดจากการตั้งค่าผิดพลาดที่ทำให้โมเดลได้รับการเข้าถึงเครือข่ายซึ่งไม่ควรได้รับ
โมเดลเหล่านี้ทำให้ระบบการผลิตขององค์กรสามแห่งที่ไม่เปิดเผยชื่อล้มเหลว โดยใช้เทคนิคเช่น การโจมตีแบบ SQL injection และการขโมยข้อมูลการเข้าสู่ระบบ
Anthropic ได้เน้นย้ำว่าเหตุการณ์เหล่านี้ไม่ได้เกี่ยวข้องกับการหลบหนีแบบตั้งใจของโมเดลหรือการขโมยข้อมูลโดยอัตโนมัติ บริษัทระบุว่าการละเมิดเกิดจาก “สมมติฐานเกี่ยวกับคำสั่งประเมินและการตั้งค่าสภาพแวดล้อมที่ผิดพลาด”
ในทางแยก เหตุการณ์ในเดือนมีนาคม 2026 เปิดเผยโค้ดส่วนใหญ่ของ Claude เอง ไฟล์ .map ที่ถูกลืมนำไปสู่การรั่วไหลของไฟล์ 1,906 ไฟล์ ซึ่งมีโค้ดของ Claude มากกว่า 64,000 บรรทัด
จากนั้นในเดือนเมษายน การเข้าถึงแบบไม่ได้รับอนุญาตต่อโมเดล Mythos ถูกติดตามย้อนกลับไปยังการรั่วไหลของข้อมูลที่เกิดขึ้นกับผู้ให้บริการภายนอกที่ Mercor
สิ่งที่ Anthropic กำลังพูด
การตอบสนองของบริษัทได้ดำเนินตามแนวทางที่คุ้นเคย: หยุดกิจกรรมที่เป็นอันตราย แบนบัญชีที่เกี่ยวข้อง แจ้งให้ผู้ได้รับผลกระทบทราบ และสัญญาว่าจะเสริมสร้างมาตรการป้องกันภายในและกระบวนการทบทวน
บัตรระบบที่เผยแพร่สำหรับ Opus 4.6 ยอมรับว่าความเสี่ยงที่เกี่ยวข้องกับ “ความไม่สอดคล้องกันในระดับสูง” มีค่าต่ำแต่ “ไม่สามารถมองข้ามได้” Anthropic ยังระบุถึงการปรับปรุงความทนทานต่อการฉีดคำสั่งตั้งแต่เดือนกุมภาพันธ์ 2026 ซึ่งบ่งชี้ว่าบริษัทมีความรู้เกี่ยวกับช่องโหว่ที่ถูกใช้ในการโจมตีเมื่อเดือนมกราคม
เส้นเวลาดังกล่าวคุ้มค่าที่จะพิจารณาอย่างละเอียด หาก Anthropic รับรู้ถึงจุดอ่อนด้านการฉีดคำสั่งและกำลังทำงานหาวิธีแก้ไขอยู่ในเดือนกุมภาพันธ์ การโจมตีในเดือนมกราคมเกิดขึ้นขณะช่องโหว่เหล่านั้นยังคงมีอยู่ในรุ่นต้นแบบ
Anthropic ได้กำหนดตัวเองเป็นห้องปฏิบัติการ AI ที่เน้นความปลอดภัยเป็นอันดับแรกนับตั้งแต่ก่อตั้งในปี 2021 โดยนักวิจัยจาก OpenAI ที่ลาออกไปคือ Dario และ Daniela Amodei นโยบายการขยายขนาดอย่างรับผิดชอบของบริษัทถูกออกแบบมาเพื่อเป็นมาตรฐานทองคำของอุตสาหกรรมในการลดความเสี่ยงที่อาจนำไปสู่หายนะ
ปัญหาความปลอดภัยของ AI ในภาพรวม
การละเมิดในเดือนมกราคมมีความน่าสนใจเป็นพิเศษ แฮกเกอร์ไม่จำเป็นต้องบุกเข้าไปในเซิร์ฟเวอร์ของ Anthropic หรือขโมยน้ำหนักของโมเดล พวกเขาใช้ประโยชน์จากตัวโมเดลเอง โดยใช้การหลบเลี่ยงเพื่อข้ามคำสั่งด้านความปลอดภัยและสั่งให้ Claude เข้าถึงและส่งออกข้อมูลของรัฐบาล
การละเมิดของรัฐบาลเม็กซิโกมีน้ำหนักทางภูมิรัฐศาสตร์ การที่ข้อมูลผู้เสียภาษีเกือบ 200 ล้านรายและข้อมูลผู้มีสิทธิเลือกตั้งตกอยู่ในมือของบุคคลที่ไม่ได้รับอนุญาต ทำให้เกิดความกังวลเกี่ยวกับการโจรกรรมตัวตน การแทรกแซงการเลือกตั้ง และความมั่นคงแห่งชาติ
การรั่วไหลของผู้ให้บริการผ่าน Mercor ที่เปิดเผยโมเดล Mythos ยังเน้นย้ำว่าท่าทีด้านความปลอดภัยของบริษัท AI มีความแข็งแกร่งเท่ากับพันธมิตรภายนอกที่อ่อนแอที่สุดของพวกเขา
