แขนหุ่นยนต์มีประวัติที่ชัดเจนว่าไม่ดีในการจับสิ่งของ แต่ Claude Fable 5.1 ของ Anthropic ที่เปิดตัวเมื่อวันที่ 1 กันยายน 2026 ได้สร้างความก้าวหน้าอย่างมีนัยสำคัญต่อปัญหานี้
โมเดลนี้มีอัตราความสำเร็จ 40% ในการทำงานแบบหยิบและวางของหุ่นยนต์ เพิ่มขึ้นจาก 5% ของรุ่นก่อนหน้า Claude Fable 5
มีการเปลี่ยนแปลงอะไรบางอย่างภายใต้hood
Fable 5.1 ถูกออกแบบมาสำหรับงานเชิงเอเจนต์ที่มีระยะเวลายาว ซึ่งเป็นประเภทงานที่โมเดลต้องวางแผน ดำเนินการ และฟื้นตัวผ่านหลายขั้นตอนโดยไม่ต้องมีมนุษย์ช่วยเหลือตลอดเวลา ระบบการเขียนโค้ด กระบวนการทำงานวิจัยทางวิทยาศาสตร์ และการอัตโนมัติทางธุรกิจที่ซับซ้อนคือเป้าหมายหลัก
ตัวเลขมาตรฐานสะท้อนให้เห็นถึงความมุ่งเน้นนี้ โดยบน Terminal-Bench-Science Fable 5.1 ได้คะแนน 52.6% เมื่อเทียบกับ 24.7% ของ Fable 5 OSWorld 2.0 การเสร็จสิ้นอย่างเข้มงวดเพิ่มขึ้นจาก 36.1% เป็น 41.7% AutomationBench ซึ่งทดสอบการอัตโนมัติซอฟต์แวร์หลายขั้นตอน เพิ่มขึ้นจาก 17.1% เป็น 31.4%
ข้อเสนอแนะจากลูกค้าหลังเปิดตัวสอดคล้องกับเรื่องราวมาตรฐาน ผู้ใช้งานระดับองค์กรระบุโดยเฉพาะว่าความน่าเชื่อถือดีขึ้นในโครงการที่ใช้เวลาเป็นชั่วโมง ไม่ใช่นาที โดยโมเดลสามารถดำเนินการเหล่านั้นโดยใช้โทเค็นน้อยกว่ารุ่นก่อนหน้า
การคำนวณราคาน่าสนใจกว่าที่ดู
ราคาพื้นฐานสำหรับ Fable 5.1 ยังคงที่ระดับ $10 ต่อล้านโทเค็นขาเข้า และ $50 ต่อล้านโทเค็นขาออก เหมือนกับรุ่นก่อนหน้า
ค่าใช้จ่ายในการอ่านแคชลดลง 75% เหลือ 0.25 ดอลลาร์ต่อล้านโทเค็น Anthropic ประมาณการว่าการลดแคชส่งผลให้ประหยัดได้ประมาณ 25% บนภาระงานทั่วไป สำหรับสายการผลิตแบบเอเจนต์ที่ซับซ้อนยิ่งขึ้น การประหยัดสามารถสูงถึง 45%
โมเดลนี้พร้อมใช้งานสำหรับผู้ใช้ระดับ Pro, Max, Team และ Enterprise และสามารถเข้าถึงได้ผ่าน API และตลาดคลาวด์หลัก
ทำไมตัวเลขหุ่นยนต์จึงสมควรได้รับการพูดคุยเป็นของตัวเอง
การปรับปรุงการจับและวางเป็นตัวเลขหลัก แต่ควรพิจารณาว่าทำไมมาตรฐานเฉพาะนี้จึงมีความสำคัญ การจับและวางเป็นตัวแทนของความสามารถในการเชื่อมโยงกับโลกแห่งความเป็นจริง: โมเดลปัญญาประดิษฐ์สามารถแปลงการให้เหตุผลเชิงนามธรรมเป็นคำสั่งการเคลื่อนไหวที่แม่นยำในโลกแห่งความเป็นจริงได้หรือไม่? งานนี้เกี่ยวข้องกับการรับรู้วัตถุ การให้เหตุผลเชิงพื้นที่ การวางแผนการจับ และการฟื้นตัวจากข้อผิดพลาดเมื่อเกิดปัญหา
อัตราความสำเร็จ 5% ถือเป็นเสียงรบกวนโดยพื้นฐาน อัตรา 40% ยังไม่ดีพอสำหรับการใช้งานในอุตสาหกรรมแบบไม่มีการควบคุม แต่ได้ข้ามขีดจำกัดที่เทคโนโลยีนี้กลายเป็นประโยชน์ในฐานะชั้นช่วยเหลือของมนุษย์ มากกว่าจะเป็นเพียงเรื่องน่าสนใจ
บริบทการแข่งขัน
ผู้ประเมินอิสระจัดอันดับ Claude Fable 5.1 อยู่ในระดับเท่ากับหรือสูงกว่าผู้นำก่อนหน้าบนดัชนีความฉลาดทันทีหลังเปิดตัว รูปแบบการปรับปรุงผ่าน Terminal-Bench-Science, OSWorld 2.0 และ AutomationBench บ่งชี้ว่า Anthropic มุ่งเป้าไปที่ลูกค้าองค์กรที่ดำเนินงานกระบวนการที่ซับซ้อน หลายขั้นตอน และใช้เวลาหลายชั่วโมง มากกว่าผู้ใช้ทั่วไปที่ถามคำถามอย่างรวดเร็ว
