ChainThink รายงานว่า เมื่อวันที่ 14 เมษายน ตามการติดตามของ 1M AI News Google DeepMind เปิดตัว Gemini Robotics-ER 1.6 ซึ่งถูกกำหนดให้เป็นโมเดลการให้เหตุผลระดับสูงสำหรับหุ่นยนต์ โมเดลนี้มีการปรับปรุงอย่างมีนัยสำคัญในด้านการให้เหตุผลเชิงพื้นที่และการเข้าใจมุมมองหลายมุมเมื่อเทียบกับรุ่นก่อนหน้า ER 1.5 และ Gemini 3.0 Flash และขณะนี้ได้เปิดให้นักพัฒนาเข้าถึงผ่าน Gemini API และ Google AI Studio
การอัปเกรดหลักประกอบด้วยสามความสามารถ: หนึ่ง ความแม่นยำในการชี้เป้าเพิ่มขึ้น สามารถตรวจจับวัตถุอย่างแม่นยำ นับจำนวน ให้เหตุผลเกี่ยวกับความสัมพันธ์เชิงพื้นที่ และวางแผนเส้นทางการเคลื่อนไหว พร้อมปฏิเสธการชี้ไปยังวัตถุที่ไม่มีอยู่ในภาพได้อย่างถูกต้อง; สอง การตรวจจับจากมุมมองหลายมุม สามารถรวมข้อมูลจากกล้องหลายตัวเพื่อประเมินสถานะการเสร็จสิ้นงาน และยังคงความแม่นยำแม้ในสภาพที่มีสิ่งกีดขวางหรือสิ่งแวดล้อมที่เปลี่ยนแปลง; สาม เพิ่มความสามารถในการอ่านค่าจากเครื่องมือวัด สามารถตีความเครื่องมืออุตสาหกรรม เช่น แรงดันแบบวงกลม ตัวชี้ระดับของเหลวแบบแนวตั้ง และหน้าจอแสดงผลดิจิทัล โดยใช้ agentic vision เพื่อให้เกิดการให้เหตุผลแบบขั้นตอน
ความสามารถในการอ่านค่าบนแผงวัดนี้มาจากความร่วมมือระหว่าง DeepMind และ Boston Dynamics ในวันเดียวกัน Boston Dynamics ประกาศว่าได้รวม Gemini และ Gemini Robotics-ER 1.6 เข้ากับผลิตภัณฑ์ Orbit AIVI-Learning ซึ่งเปิดใช้งานสำหรับลูกค้าทุกคนของ AIVI-Learning ตั้งแต่วันที่ 8 เมษายน หลังจากการรวมกัน ระบบแผงควบคุมใหม่ได้รับการสนับสนุน หุ่นยนต์สี่ขา Spot สามารถตรวจตราด้วยตนเองในสถานที่อุตสาหกรรมและอ่านข้อมูลจากแผงวัด เช่น แรงดัน
Boston Dynamics ระบุว่า ด้วยความสามารถในการให้เหตุผลของ Gemini AIVI-Learning ได้ปรับปรุงประสิทธิภาพพื้นฐานและระดับความแม่นยำในงานต่างๆ ที่มีอยู่ เช่น การตรวจสอบด้วยภาพ การนับพาเลท และการตรวจจับของเหลวสะสม DeepMind ระบุว่า ER 1.6 เป็น "โมเดลหุ่นยนต์ที่ปลอดภัยที่สุด" ของพวกเขา โดยมีระดับการปฏิบัติตามคำสั่งด้านความปลอดภัยดีกว่า ER 1.5 ในงานเชิงตรรกะเชิงต่อต้าน; ในการทดสอบการระบุความเสี่ยงด้านความปลอดภัยจากรายงานการบาดเจ็บจริง โมเดล ER แสดงผลเหนือกว่า Gemini 3.0 Flash ถึง 6% ในสถานการณ์ข้อความ และ 10% ในสถานการณ์วิดีโอ
