20 اگست کو، ایک نامعلوم AI ماڈل جس کا نام Ox Alpha ہے، OpenRouter، OpenCode، Cline اور Nous Research کے Portal پلیٹ فارم پر مفت استعمال کے لیے دستیاب ہوا۔ چونکہ اس پر کوئی کمپنی کا نام نہیں تھا، اس "انکار کردہ ماڈل" کو ڈویلپرز کے دائرے میں جلد ہی توجہ حاصل ہوئی۔
گرمی کے ابتدائی اضافے کا سبب ایک تیزی سے پھیلنے والی کوڈنگ بینچ مارک کی رپورٹ تھی۔ ڈویلپر بن ڈیویس نے DeepSWE کے 10 ٹاسک سیmpls میں ٹیسٹ کرنے کے بعد 80% فرسٹ اسٹرائیک ریٹ حاصل کیا، جو Claude Fable 5 کے 65% اور GPT-5.6 Sol کے 52% سے زیادہ تھا۔ اس نتیجہ کو بعد میں بہت سے لوگوں نے شیئر کیا، جس کی وجہ سے باہر کے لوگوں نے سمجھا کہ Ox Alpha موجودہ لیڈنگ ماڈلز سے واضح طور پر آگے نکل گیا ہے۔
مکمل ٹیسٹ تقریباً 63% پر واپس آ گیا
DeepSWE ایک بینچ مارک ہے جو کوڈ ایجینٹس کے لیے ہے اور یہ پیمانہ ہے کہ ماڈل حقیقی GitHub مسائل کو پہلی کوشش میں حل کر سکتا ہے یا نہیں۔ اس بینچ مارک میں 91 کوڈ ریپوزٹریز پر مشتمل 113 کام ہیں۔
مذکورہ دو الگ الگ مکمل ٹیسٹس کے مطابق، Ox Alpha کا اسکور تقریباً 63% پر رہا، جو GPT-5.6 Sol کے سطح کے تقریباً برابر ہے، نہ کہ مستقل طور پر اس سے زیادہ۔ یعنی، پہلے عام طور پر پھیلائے گئے "80% کی برتری" کا زیادہ تر تعلق چھوٹے نمونوں کے نتائج سے تھا، جن میں تبدیلی کا سامنا زیادہ تھا۔
22 اگست تک، Ox Alpha ابھی تک مقبول ماڈل رینکنگز جیسے Artificial Analysis یا LMSys Arena میں شامل نہیں ہے، جس کا مطلب ہے کہ اس کے لیے عوامی جائزہ کے ڈیٹا اب بھی محدود ہیں۔
مفت کھولنے سے توجہ بڑھی
کارکردگی کی بحث کے علاوہ، پلیٹ فارم کے ذریعہ دی گئی کھلی شرائط نے دلچسپی کو بھی بڑھایا۔ OpenCode نے کہا کہ اس کا روتنگ روزانہ 100 ٹریلین ٹوکنز کے معالجہ کو سپورٹ کرتا ہے؛ جبکہ Nous Research نے دعویٰ کیا کہ ان کا پورٹل روزانہ 1000 ٹریلین ٹوکنز کی صلاحیت رکھتا ہے۔
- لگभگ ایک ہفتہ تک مفت کھلا ہے
- 100 ہزار کے کنٹیکسٹ ونڈو کی حمایت
- بہت سے ماڈلز کی درخواست اور صفر ڈیٹا محفوظ کرنے کی سہولت
اسٹرائپ کے سی ای او پیٹرک کولیسن نے ایکس پلیٹ فارم پر بھی لکھا کہ یہ ماڈل "بہت متاثر کن" ہے۔ یہ مختصر جائزہ Ox Alpha کے بارے میں بحث کو مزید بڑھا دیا۔
فینگرپرنٹ تجزیہ سے چیپو AI کی طرف اشارہ ہوتا ہے
ابھی تک کوئی بھی ادارہ Ox Alpha کو اپنا نہیں کہتا۔ اس کے ماخذ کے حوالے سے باہر کئی جانچیں ہو چکی ہیں۔
رپورٹ میں کہا گیا ہے کہ کچھ عام امیدواروں کو جزوی طور پر خارج کر دیا گیا ہے۔ مثال کے طور پر، می میمو v2.5 آڈیو ان پٹ کو سپورٹ کرتا ہے، جبکہ Ox Alpha آڈیو کو واضح طور پر مسترد کرتا ہے؛ DeepSeek نے پہلے کبھی ویڈیو کی صلاحیت نہیں جاری کی اور عام طور پر انسٹال کردہ وزن جاری کرتا ہے، نہ کہ پہلے اناںٹیڈ پریویو؛ Google اور Qwen کے ٹوکنائزیر اور ویڈیو اینکوڈنگ طریقے بھی Ox Alpha سے مطابقت نہیں رکھتے۔
باقی شواہد زیادہ تر زہ پو AI کی طرف اشارہ کرتے ہیں۔ مستقل محققین کے انگریزی ٹیسٹ نے ظاہر کیا کہ Ox Alpha کا ٹوکنائزیر معیاری ٹیسٹ میں GLM-5.3 کے ساتھ مکمل طور پر مطابقت رکھتا ہے، اور اس کا ویڈیو ٹوکن استعمال بھی چار ویڈیو نمونوں میں GLM-5V-Turbo کے ساتھ مکمل طور پر ملتا جلتا ہے، ساتھ ہی یہ GLM سیریز کے مشابہ غلط خصوصیات اور آڈیو ان پٹ کو مسترد کرنے کا رویہ بھی ظاہر کرتا ہے۔
تاہم، اس جائزے میں ابھی ایک شک ہے۔ GLM-5.3 کو 14 اگست کو صرف ٹیکسٹ ماڈل کے طور پر جاری کیا گیا تھا، جبکہ Ox Alpha نے 20 اگست کو مکمل ویڈیو صلاحیت کے ساتھ لانچ کیا۔ اس وقت کے فرق کو دیکھتے ہوئے، اگر اوپر کا نشانہ جانچ صحیح ہے، تو Ox Alpha زیادہ احتمال ہے کہ GLM-5.3 سیریز کا ابھی تک غیر من公开 کردہ متعدد ماڈل اپگریڈ ہو، نہ کہ موجودہ ماڈل کا براہ راست نقل۔
"چھپا ہوا ماڈل" کا مطلب عام طور پر وہ ماڈل ہے جس کی ترقی کرنے والی ادارہ اپنا نام نہیں دیتی، بلکہ پہلے OpenRouter جیسے راؤٹنگ پلیٹ فارم کے ذریعے ماڈل جاری کرتی ہے تاکہ حقیقی استعمال کے ڈیٹا کو جمع کیا جا سکے، اور پھر فیصلہ کیا جائے کہ کیا اسے باضابطہ طور پر جاری کیا جائے۔ رپورٹ میں بتایا گیا ہے کہ یہ عمل کچھ چینی AI لیبز میں کافی عام ہو چکا ہے۔ OpenCode کے مطابق، Ox Alpha کی مفت دستیابی کا دور تقریباً 27 اگست تک جاری رہے گا، اور اس وقت اس کی حقیقی شناخت کا انکشاف ہوگا یا نہیں، بازار کا ایک اہم نقطہ توجہ ہے۔
