หากคุณเคยสงสัยว่าเรามาถึงจุดที่ระบบ AI สามารถออกแบบเวอร์ชันที่ดีกว่าตัวเองได้ใกล้แค่ไหน Vals AI เพิ่งสร้างตารางคะแนนขึ้นมาแล้ว ดัชนีการปรับปรุงตนเองแบบวนซ้ำ (Recursive Self-Improvement Index หรือ RSI Index) ของบริษัทพยายามวัดสิ่งที่จนถึงขณะนี้ยังคงอยู่ในขอบเขตของความกังวลเชิงทฤษฎี: โมเดลระดับแนวหน้าในปัจจุบันมีความสามารถเพียงใดในการดำเนินการวิจัยและพัฒนาที่จำเป็นเพื่อสร้างรุ่นถัดไปของตัวเอง?
โมเดลที่ทำผลงานดีที่สุดบนดัชนี Claude Fable 5.1 ได้คะแนน 35.03% ซึ่งดูเหมือนต่ำ จนกว่าคุณจะเข้าใจขอบเขตของมัน
การทำงานของดัชนี RSI จริงๆ คืออะไร
Vals AI ออกแบบดัชนีรอบห้าภารกิจเฉพาะที่สะท้อนกระบวนการพัฒนา AI จริง โมเดลจะถูกประเมินภายใต้ข้อจำกัดด้านการคำนวณและเวลา หมายความว่าพวกเขาไม่สามารถใช้วิธีการคำนวณแบบแรงๆ เพื่อให้ได้คะแนนดีโดยการใช้ทรัพยากรไม่จำกัด
ระบบการให้คะแนนอิงจากจุดอ้างอิงแทนการให้คะแนนแบบสุ่ม คะแนน 0 แสดงถึงระดับพื้นฐาน คะแนน 0.5 สอดคล้องกับระดับประสิทธิภาพที่ได้รับการบันทึกไว้ในงานวิจัยที่ตีพิมพ์แล้ว และค่าที่ดีที่สุดเชิงทฤษฎีอยู่ที่ 1
คะแนนของ Claude Fable 5.1 ที่ 35.03% หมายความว่ามันทำงานได้ดีอย่างมีนัยสำคัญ แต่ยังไม่สามารถเลียนแบบเทคนิคที่นักวิจัยรู้จักอยู่แล้ว โมเดลเหล่านี้สามารถทำผลงานได้ดีกว่าเทคนิคที่มีอยู่ในด้านการดำเนินการทดลอง แต่โดยทั่วไปแล้วยังตามหลังในการสร้างเทคนิคใหม่ๆ
เหตุใดสิ่งนี้จึงสำคัญในตอนนี้
ดัชนี RSI ถูกเปิดตัวในเดือนสิงหาคม 2026 ผ่านความร่วมมือระหว่าง Vals AI และ CoreWeave ซึ่งตรงกับรอบการระดมทุน Series A มูลค่า 40 ล้านดอลลาร์สหรัฐของบริษัท รอบการระดมทุนนี้มีมูลค่าของ Vals AI อยู่ที่ 400 ล้านดอลลาร์สหรัฐ
ซีอีโอไรอัน คริชนาն ได้กำหนดดัชนีนี้ให้เติมช่องว่างที่สำคัญ ห้องปฏิบัติการปัญญาประดิษฐ์รายใหญ่ได้เริ่มอ้างถึงศักยภาพของการปรับปรุงตนเองแบบวนซ้ำในบัตรโมเดลของพวกเขาแล้ว แต่โดยไม่มีกรอบมาตรฐานสำหรับการเปรียบเทียบ การอ้างอิงเหล่านั้นจึงขาดพื้นฐานร่วมในการประเมิน
ในหกเดือนหลังจากการระดมทุน รายได้ของ Vals AI เพิ่มขึ้น 8 เท่าเมื่อเทียบกับทั้งปี 2025 ฐานลูกค้าเพิ่มเป็นสองเท่า และจำนวนพนักงานเพิ่มเป็นสามเท่า
คำถามการกำกับดูแล
คริชนาնได้แสดงความเห็นอย่างชัดเจนเกี่ยวกับสิ่งที่ดัชนี RSI บ่งชี้เกี่ยวกับการกำกับดูแล ข้อกังวลไม่ได้อยู่ที่โมเดลที่ให้คะแนน 35% จะเริ่มหลุดควบคุม แต่อยู่ที่แนวโน้มจากการให้คะแนน 35% ไปสู่คะแนนที่สูงขึ้นอาจชันมาก และการพัฒนาความสามารถเหล่านี้กำลังเกิดขึ้นภายในห้องปฏิบัติการไม่กี่แห่งที่มีการมองเห็นจากภายนอกจำกัด
คริชนาնได้เน้นย้ำถึงความจำเป็นในการสร้างโครงสร้างการกำกับดูแลระดับนานาชาติให้ทันต่อความก้าวหน้าเหล่านี้ ดัชนี RSI ให้พื้นฐานเชิงประจักษ์แก่เรื่องนี้: มันยากที่จะปฏิเสธเสียงเรียกร้องให้มีการกำกับดูแลเมื่อคุณสามารถชี้ไปที่ตัวชี้วัดที่ชัดเจนซึ่งแสดงถึงความก้าวหน้าที่วัดได้ toward การปรับปรุงตนเองอย่างอิสระ
