Mensahe ng ChainThink, Abril 14: Ayon sa pagmamasid ng 1M AI News, inilabas ng Google DeepMind ang Gemini Robotics-ER 1.6, na inilalarawan bilang isang high-level reasoning model para sa robot. Mas nagkaroon ng malaking pagpapabuti ang modelo sa spatial reasoning at multi-view understanding kumpara sa nakaraang bersyon na ER 1.5 at Gemini 3.0 Flash, at kasalukuyang available na ito sa mga developer sa pamamagitan ng Gemini API at Google AI Studio.
Ang pangunahing pagpapabuti ay naglalaman ng tatlong kakayahan: una, ang pagpapabuti sa pagtutukoy ng kahusayan, na nagpapahintulot sa eksaktong paghahanap, pagbilang, pag-iisip sa espasyal na ugnayan, at pagplano ng trayektorya ng galaw, at makakatanggap ng tamang pagtanggi sa pagtutukoy sa mga bagay na hindi nasa screen; pangalawa, ang matagumpay na pagdetekta mula sa maraming pananaw, na nakakapagpagsasama ng mga imahe mula sa maraming camera upang masukat ang pagkakatapos ng gawain, at nananatiling akurat kahit sa pagkakasakop o dinamikong kapaligiran; at pangatlo, ang pagdaragdag ng kakayahan sa pagbasa ng mga instrumento, na nakakaintindi ng mga round pressure gauge, vertical level indicators, digital displays, at iba pang industriyal na instrumento, gamit ang agentic vision para sa pag-iisip nang paunlari.
Ang kakayahan ng dashboard na ito ay nagmula sa pagkakasundo ng DeepMind at Boston Dynamics. Ipinahayag din ng Boston Dynamics sa parehong araw na ang Gemini at Gemini Robotics-ER 1.6 ay nai-integrate sa produkto ng Orbit AIVI-Learning, at ipinakilala sa lahat ng mga customer ng AIVI-Learning noong Abril 8. Matapos ang integrasyon, idinagdag ang suporta para sa dashboard, kaya ang four-legged robot na Spot ay makakapag-autonomous na paglalakbay at mababasa ang mga data ng mga instrumento tulad ng pressure gauge sa mga industriyal na pasilidad.
Sinabi ng Boston Dynamics na ang AIVI-Learning ay nagpakita ng pagpapabuti sa baseline na performance at akurasyon sa mga gawain tulad ng visual inspection, pagbilang ng pallet, at pagdetekta ng pagkakaroon ng likido, gamit ang pag-iisip ng Gemini. Sinabi ng DeepMind na ang ER 1.6 ay ang "pinakaligtas na robot model" nito, na may mas mataas na pagsumbong sa mga safe instruction sa mga adversarial spatial reasoning task kaysa sa ER 1.5; sa mga pagsubok sa pagkilala sa safety risk batay sa totoong ulat ng pinsala, mas mataas ang ER series model sa 6% sa text scenario at 10% sa video scenario kaysa sa Gemini 3.0 Flash.
