چین تھنک کی خبر، 14 اپریل، 1M AI News کی نگرانی کے مطابق، گوگل ڈیپ مائنڈ نے جیمنی روبوٹکس-ایر 1.6 جاری کیا ہے، جسے روبوٹکس کے لیے اعلیٰ استدلال ماڈل کے طور پر پیش کیا گیا ہے۔ یہ ماڈل اپنے پچھلے نسخہ ER 1.5 اور جیمنی 3.0 فلیش کے مقابلے میں فضائی استدلال اور متعدد مناظر کی سمجھ میں نمایاں بہتری لائے ہے، اور اب اسے جیمنی API اور گوگل AI سٹوڈیو کے ذریعہ ڈویلپرز کے لیے دستیاب کر دیا گیا ہے۔
مرکزی اپ گریڈ میں تین صلاحیتیں شامل ہیں: ایک، جہت کی درستگی میں اضافہ، جس سے درست جسمانی تشخیص، شمار، فضائی تعلق کا استنباط اور حرکت کے راستے کی منصوبہ بندی ممکن ہو جاتی ہے، اور یہ تصویر میں موجود نہ ہونے والے اشیاء کو درست طریقے سے مسترد کر سکتی ہے؛ دو، متعدد مناظر میں کامیاب تشخیص، جو کئی کیمرے کی تصاویر کو ملا کر کام کی تکمیل کا جائزہ لے سکتی ہے، اور اسکرین پر چھپنے یا حرکت کے ماحول میں بھی درست رہتی ہے؛ تین، نئی اسکیل پڑھنے کی صلاحیت، جو گول دباؤ میٹر، عمودی سطح انڈیکیٹرز، ڈیجٹل ڈسپلے جیسے صنعتی اسکیلز کو پڑھ سکتی ہے، اور agentic vision کے ذریعے مرحلہ وار استنباط کرتی ہے۔
یہ ڈیش بورڈ پڑھنے کی صلاحیت DeepMind اور Boston Dynamics کے تعاون سے حاصل ہوئی ہے۔ Boston Dynamics نے اسی دن اعلان کیا کہ انہوں نے Gemini اور Gemini Robotics-ER 1.6 کو Orbit AIVI-Learning پروڈکٹ میں اندراج کر دیا ہے، جو 8 اپریل کو تمام AIVI-Learning صارفین کے لیے لائیو ہو گیا۔ اندراج کے بعد نئے ڈیش بورڈ سپورٹ کے ساتھ، چار پاؤں والے روبوٹ Spot صنعتی اداروں میں خود مختار طور پر گشت کر سکتا ہے اور دباؤ گیج جیسے ڈیش بورڈز کا ڈیٹا پڑھ سکتا ہے۔
بوسٹن ڈائنامکس کے مطابق، جیمینی کی استدلالی صلاحیتوں کے ذریعے، AIVI-Learning کی پہلے سے موجودہ ویژول انسپکشن، ٹرے گنتی، اور ترساب کی تشخیص جیسے کاموں پر بنیادی کارکردگی اور درستگی میں اضافہ ہوا ہے۔ ڈیپ مائنڈ کا کہنا ہے کہ ER 1.6 ان کا "سب سے محفوظ روبوٹ ماڈل" ہے، جو مقابلہ کی جانے والی استدلالی کارروائیوں میں ER 1.5 کے مقابلے میں محفوظ حکمات کی پابندی زیادہ بہتر ہے؛ اور حقیقی زخمی رپورٹس پر مبنی محفوظ خطرات کی شناخت کے ٹیسٹ میں، ER سیریز ماڈلز Gemini 3.0 Flash کے مقابلے میں متن کے منظر میں 6% اور ویڈیو کے منظر میں 10% زیادہ ہیں۔
