گوگل نے AI ایجینٹ کی کارکردگی اور رفتار بہتر بنانے کے لیے تین نئے جیمینی ماڈلز لانچ کیے ہیں

iconTechFlow
بانٹیں
AI summary iconخلاصہ
گوگل نے AI ایجینٹ کی کارکردگی کو بڑھانے کے لیے تین نئے جیمینی ماڈلز — 3.6 Flash، 3.5 Flash-Lite، اور 3.5 Flash Cyber — شروع کیے ہیں۔ 3.6 Flash ماڈل میں ٹوکن استعمال میں 17% کمی آئی ہے اور کوڈنگ اور جانکاری کے کاموں میں بہتری ہوئی ہے۔ 3.5 Flash-Lite ہر سیکنڈ میں 350 ٹوکن تک پہنچ جاتا ہے، جو اس سیریز میں سب سے تیز ہے۔ 3.5 Flash Cyber کوڈ میں سائبر سیکورٹی کے مسائل کی شناخت اور حل پر مرکوز ہے۔ یہ اپڈیٹس AI + کرپٹو خبروں کے ساتھ مطابقت رکھتے ہیں اور اس شعبے میں نئے ٹوکن لسٹنگ پر اثر ڈال سکتے ہیں۔

مصنف: Google DeepMind

ترجمہ: شنچاؤ ٹیکفلو

شین چاؤ کا خلاصہ: گوگل نے اس بار تین ماڈلز جاری کیے ہیں جن کا مرکزی مقصد AI ایجینٹ کے تجارتی عمل میں آنے والے اصل مسائل — لاگت اور رفتار — کو حل کرنا ہے۔ 3.6 Flash پچھلے نسخے کے مقابلے میں 17% کم ٹوکن استعمال کرتا ہے، قیمت کم ہے لیکن معیار بہتر ہے؛ 3.5 Flash-Lite کی رفتار 350 ٹوکن/سیکنڈ ہے، جو اب تک کا سب سے تیز 3.5 سیریز ماڈل ہے؛ اور خصوصی سائبر سیکورٹی ماڈل Flash Cyber کوڈ کے خامیوں کی مرمت کے لیے ضرورت مند مارکیٹ کو ہدف بناتا ہے۔ یہ صرف پرفارمنس ٹیسٹ کا کھیل نہیں، بلکہ AI ایجینٹس کو بڑے پیمانے پر لاگو کرنے کے لیے راستہ بنا رہا ہے۔

گوگل ڈیپ مائنڈ نے آج تین نئے جیمینی ماڈلز جاری کیے ہیں: 3.6 فلش، 3.5 فلش-لائٹ اور 3.5 فلش سائبر۔ یہ ماڈلز AI ایجینٹس کو بڑے پیمانے پر تعمیر کرنے کے لیے ضروری کارکردگی، تاخیر اور قابلیت کے لیے ڈیزائن کیے گئے ہیں۔

جیمنی 3.6 فلیش: زیادہ موثر، زیادہ بہتر

3.6 Flash، 3.5 Flash کے ڈیولپرز کے فیڈبیک کے بنیاد پر بہتر بنایا گیا ہے۔ یہ نہ صرف کوڈنگ اور جانچ کے کاموں میں مزید بہتری لاتا ہے، بلکہ ٹوکن کی کارکردگی میں بھی نمایاں اضافہ کرتا ہے۔ Artificial Analysis Index کے مطابق، 3.6 Flash، 3.5 Flash کے مقابلے میں 17% تک ٹوکن کے استعمال میں کمی لاتا ہے۔ کچھ بینچ مارکس جیسے Datacurve کے DeepSWE میں، یہ کمی 65% تک پہنچ جاتی ہے۔ متعدد مراحل والے ورک فلو کو مکمل کرنے کے لیے درکار استدلال کے مراحل اور ٹول کالز بھی کم ہوتے ہیں۔

اس کے ساتھ ساتھ قیمتوں میں بھی کمی آئی ہے۔ ہر ملین ان پٹ ٹوکن کی قیمت 1.5 امریکی ڈالر اور ہر ملین آؤٹ پٹ ٹوکن کی قیمت 7.5 امریکی ڈالر رکھی گئی ہے، جس سے 3.6 Flash ہر ایجینٹ کے کام کی کل لاگت کو کم کرتا ہے اور ایجینٹ بنانے اور چلانے کو مزید محفوظ بناتا ہے۔

3.6 Flash، 3.5 Flash کے مقابلے میں مختلف استعمال کے معاملات میں زیادہ کارآمد ہے:

کوڈ ایڈیٹنگ زیادہ درست ہو گئی ہے، غیر ضروری تبدیلیوں اور ایکزیکشن سائکلز کو کم کیا گیا ہے، DeepSWE پر 49% (3.5 Flash کا 37%)، اور میکن لرننگ ریسرچ بینچ مارک MLE Bench پر 63.9% تک نمایاں طور پر بہتری ہوئی ہے (3.5 Flash کا 49.7%)

کمپیوٹر آپریشن کی صلاحیت میں بہتری، OSWorld-Verified سکور 83.0% (3.5 Flash کا 78.4%)۔ کمپیوٹر آپریشن اب Gemini API اور Gemini Enterprise کے ذریعے اندرونی کلائنٹ ٹول کے طور پر دستیاب ہے۔

گزشتہ معلومات کے مطابق، GDPval-AA v2 بینچ مارک اسکور 1421 (3.5 Flash کا اسکور 1349) ہے۔ کلائنٹس جیسے ہیبیا اور ہروے نے پایا کہ یہ ڈاکیومنٹ پارس کرنے، گراف اور ڈیٹا تجزیہ، رپورٹ تیار کرنے جیسے متعدد ماڈل کاموں میں خاص طور پر بہتر کام کرتا ہے۔

گاہک کی رائے: 3.6 Flash لاگت اور معیار دونوں میں ترقی ہے، جو پیچیدہ ورک فلو اور جانچ کاموں میں ٹوکن کی کارکردگی، درستگی اور رفتار کے درمیان توازن برقرار رکھتی ہے۔

سیکورٹی ڈیزائن

3.6 فلیش میں کیمیائی، بیولوجیکل، ریڈیو ایکٹو اور ایٹمی (CBRN) اور سائبر حملوں کے غلط استعمال کے شعبوں کو شامل کرتے ہوئے بہتر شدہ ایڈوانس سیکورٹی محفوظات فراہم کی گئی ہیں۔ یہ محفوظات ماڈل کو جیل چھوڑنے والے حملوں کے خلاف مزید مضبوط بناتی ہیں۔ اس کے علاوہ، ماڈل کو تربیت دی گئی ہے تاکہ مفید استعمالات کو مسترد کرنے کا امکان کم سے کم رہے۔

Gemini 3.5 Flash-Lite: ایجینٹ ورک فلو کو سکیل کرنے کے لیے تیار

3.5 Flash-Lite کم تاخیر والے کاموں اور ایجنٹ سرچ اور دستاویزات کے معالجہ جیسے اعلیٰ ٹھروٹل کی ضرورت والے ڈویلپمنٹ سیناریوز کے لیے ڈیزائن کیا گیا ہے۔

3.5 Flash-Lite، 3.5 سیریز کا سب سے تیز مدل ہے۔ Artificial Analysis کے مطابق، یہ فی سیکنڈ 350 آؤٹ پٹ ٹوکنز کی رفتار سے چلتا ہے۔ قیمت ہر ملین ان پٹ ٹوکنز کے لیے 0.3 امریکی ڈالر اور ہر ملین آؤٹ پٹ ٹوکنز کے لیے 2.5 امریکی ڈالر ہے، اور یہ 3.1 Flash-Lite کے مقابلے میں کافی بہتر کوالٹی فراہم کرتا ہے، جس سے بڑے فلو پروڈکشن ٹاسکس کے لیے ڈویلپرز اور صارفین کو عالی سطحی قیمت اور معیار کا مجموعہ ملتا ہے۔

3.5 Flash-Lite، Agent سسٹم کے موثر اضافے کی حمایت کرتا ہے۔ مختلف سوچ کے سطح پر، یہ ماڈل 3.1 Flash-Lite کے مقابلے میں نمایاں طور پر بہتر ہے۔ ڈویلپرز اپنے کام کے بوجھ کے مطابق ماڈل کو کنفیگر کر سکتے ہیں: بڑی مقدار میں کاموں کے لیے نیچی اور کم سوچ کی سطح استعمال کریں تاکہ کم تاخیر اور کم لاگت والی انجام دہی حاصل ہو؛ یا متعدد مراحل والے سب Agent کاموں کو سنبھالنے کے لیے زیادہ سوچ کی سطح فعال کریں۔ اب یہ ماڈل کمپیوٹر آپریشنز کو بھی اندرونی ٹول کے طور پر فراہم کرتا ہے اور انٹرفیس کے درمیان Agent کاموں کو قابل اعتماد طریقے سے سپورٹ کرتا ہے۔

اس میں کوڈنگ اور ایجنٹ کے کاموں میں نمایاں بہتری آئی ہے، جیسے Terminal-Bench 2.1 پر 54% سکور (3.1 Flash-Lite پر 31%)، لمبے کانٹیکسٹ جیسے GDM-MRCR v2 پر 72.2% سکور (3.1 Flash-Lite پر 60.1%)، اور عملی کاموں جیسے GDPval-AA v2 پر 1140 سکور (3.1 Flash-Lite پر 642)۔

در واقع، بہ بہتی ایجینٹس اور کوڈنگ ایوانٹس میں، 3.5 Flash-Lite نے 3 Flash کو شامل کرتے ہوئے SWE-Bench Pro (54.2% مقابل 49.6%) اور OSWorld-Verified (74.0% مقابل 65.1%) میں بھی پار کر دیا، جس سے یہ 2.5 اور 3 Flash کے ورک لوڈ کے لیے تیز اور طاقتور ترین منتخب ہو گیا۔

ابتدائی صارفین نے 3.5 Flash-Lite کے تیزی، ذکاوت اور لاگت کی کارآمدی کے منفرد امتزاج کو ایجینٹ ورک فلو اور ڈیٹا پروسیسنگ کاموں کو وسعت دینے میں زور دیا۔

Gemini 3.5 Flash Cyber in CodeMender: خلیلیات کی مؤثر تلاش اور درستگی

ای آئی ماڈلز سیکیورٹی خامیوں کو دریافت کرنے کی رفتار اب موجودہ سسٹمز کے انہیں درست کرنے کی رفتار سے زیادہ ہے۔ اس مسلسل بڑھتے ہوئے خطرے کا مقابلہ کرنے کے لیے ایک ایسی نرم افزار سیکیورٹی کا طریقہ ضروری ہے جو کارآمد اور طاقتور دونوں ہو۔

Flash کی صلاحیت اور کارکردگی اسے بڑے پیمانے پر کوڈ سیکیورٹی مسائل کی تشخیص، تصدیق اور درست کرنے کے لیے مثالی بناتی ہے۔ Gemini 3.5 Flash Cyber، 3.5 Flash پر مبنی ہے اور نیٹ ورک سیکیورٹی خامیوں کی دریافت اور درست کرنے کے لیے خصوصی طور پر فائن ٹیونڈ کیا گیا ہے، اور ہر ٹوکن کی قیمت بڑے ماڈلز سے کم ہے۔

CodeMender میں، کئی 3.5 Flash Cyber Agent مل کر ایک یکجا رپورٹ تیار کرتے ہیں اور مقبول بنچ مارک CyberGym پر ایک جدید مقابلہ کی سطح حاصل کرتے ہیں۔

اس ٹیکنالوجی کی دوہرے استعمال والی مخصوصیت کے پیش نظر، ہم نے احتیاطی طریقہ اختیار کیا ہے۔ یہ ماڈل جلد ہی CodeMender کے ذریعے حکومت اور قابل اعتماد شراکت داروں کے لیے محدود رسائی والے پائلٹ پروجیکٹ کے طور پر فراہم کیا جائے گا۔ اس سے فرنس لائن دفاعی افراد کو اہم خامیوں کے استعمال سے پہلے ان کا پتہ لگانے اور درست کرنے کا موقع ملے گا، جبکہ وسیع پیمانے پر غلط استعمال کے خطرات کو کم کیا جائے گا۔

فوراً شروع کریں

3.6 Flash اور 3.5 Flash-Lite آج سے دستیاب ہیں:

ڈویلپرز Google AI Studio اور Android Studio کے Gemini API کے ذریعے استعمال کر سکتے ہیں۔ 3.6 Flash Google Antigravity میں بھی دستیاب ہے

کاروباری ادارے Gemini Enterprise Agent پلیٹ فارم کے ذریعے استعمال کر سکتے ہیں۔ 3.6 Flash Gemini Enterprise ایپ میں بھی دستیاب ہے

سب کو جیمنی ایپ کے ذریعے استعمال کرنے کا موقع میسر ہے۔ 3.5 Flash-Lite کو اب گوگل سرچ پر بھی لانچ کیا جا رہا ہے۔

مستقبل کے جمنی ماڈلز کو بہتر بنانے کے لیے آپ کی رائے کا انتظار ہے، ہم جلد ہی 3.5 Pro جاری کرنے کی توقع کر رہے ہیں۔

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔