source avatarDr.R

بانٹیں

آج، Anthropic نے نئے Claude Fable 5.1 / Mythos 5.1 (ایک ہی ماڈل، لیکن مختلف سیکیورٹی لیولز) کا اعلان کیا ہے، جو ایک درمیانی اپ ڈیٹ ہے جس میں صرف تھوڑی سی بہتری ہوئی ہے، لیکن ہمارے لیے اس کا اہم ترین پہلو استحکام میں اضافہ اور قیمت میں کمی ہے۔ آفیشل اپ ڈیٹ درج ذیل ہے: 1. سائنسی agentic صلاحیتوں میں سب سے زیادہ بہتری Terminal-Bench-Science میں Fable 5 کے 24.7% سے بڑھ کر 52.6% ہو گیا، تقریباً دگنا، جو Opus 5 کے 29.0% سے کافی زیادہ ہے۔ 2. کوڈنگ اور لمبے وقت تک بے نگہبان کام Terminal-Bench 4.0 میں 42.0% سے بڑھ کر 55.8% ہو گیا (Mythos 5.1 میں 60.9%)، CursorBench 3.2.0 میں 73.4% تک پہنچا۔ Millennium نے اس ماڈل کا استعمال کرتے ہوئے ایک ایسا کرشر تلاش کیا جسے اپنی ٹیم نے چار سے پانچ سال تک نہیں پایا تھا اور دوسرے ماڈلز نے بھی نظر انداز کر دیا تھا، جو صرف ایک ملین میں ایک کامن امکان تھا۔ 3. قیمت میں تقریباً 25% کمی کیش ریڈنگ (cache read) کی قیمت 75% کم ہو کر $0.25/ملین ٹوکن ہو گئی، عام لوڈ کے لیے کل لاگت میں تقریباً 25% کمی آئی، اور شدید agentic صورتحال میں تک تقریباً 45% تک کمی۔ ان پٹ $10 اور آؤٹ پٹ $50 / ملین ٹوکن وہی رہے۔ 4. کم محنت سے بھی کافی Low/Medium سطح پر رکھنے پر فعالیت Fable 5 کے برابر یا اس سے زیادہ ہے، لیکن لاگت بہت کم — لاگت پر حساس صورتحالوں میں آپ براہ راست نچلے لیول پر جا سکتے ہیں۔ 5. سلامتی فلٹرز میں غلط روکاوٹ میں کمی Claude Code میں سائبر سلامتی فلٹرز کے انٹر塞پشنز متوسط طور پر تقریباً 60% کم ہوئے، اور اب آپ اس کا استعمال خرابیوں کا پتہ لگانے کے لیے بھی کر سکتے ہیں (ابھی تک exploit لکھنا، پینٹرست ٹيسٹنگ، یا بائنری اسکیننگ ممنوع ہے — ان کے لیے Opus استعمال کریں)۔ بائولوجیکل سوالات (بنیادی بائولوجی، طبّی سوالات) میں غلط فعال ہونے میں 85% کمی آئی۔ 6. کاروباری ڈे�ٹا رکھنے کا حل نئے Enterprise Frontier Safeguards (EFS) کے ذریعے، ڈे�ٹا Anthropic پر نہ رکھ کر صارف کے اپنے کلاؤڈ پر محفوظ ہوتا ہے، جس سے صفر ڈे�ٹا رکھنے جسا دسترس حاصل ہوتا ہے — اس کا مرحلہ وار اطلاق خزاں میں شروع ہوگا؛ اس سے پہلے، اہل صارفین فوراً صفر رکھنے والے طرīقے سے استعمال کر سکتے ہیں۔ 7. پچھلے نسخے سے بہتر تطابق اس ماڈل میں ٹيسٹنگ ماحول سے باہر وسائل حاصل کرنے کا رجحان کم، "اس مصنوعات/تجربات" جیسے دلائل استعمال کرنے سے خود کو بچانے کا رجحان کم، reward hacking کرنے کا رجحان اور اس کاموفقیت دونوں کم، اور حالات مطابق prompt injection کے لحاظ سے سب سے زائد مستحکم ماڈل۔ دو اور نکات جن پر توجہ دینا ضروری ہے: نئے API اکاؤنٹس میں دوبارہ باتچینٹ میں Claude کے سابقہ خود فکر (thought process) کو دستکارانہ طور پر تبدیل نہीں کیا جا سکتا (خواصِ تقلید روکنے کے لئے)، اور آؤٹ پٹ میں EU AI Act کے تقاضوں کے مطابق ادراک نہ ہونے والے پانچوں (invisible watermark) شامل ہوں گے، جو مواد کی معیار پر اثر نہीں ڈالتے اور صارفین کی معلومات نہीں رکھتے۔

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔