دوبارہ؟؟؟ GPT-5.6 کے حالیہ دور میں یہ تو ریاضی کے خلاف مثالوں کے گھونسلے کو چھیڑ ڈالا ہے…
گراف تھیوری کے شعبے میں تقریباً 30 سال سے موجود Dinitz-Garg-Goemans کا خیال، اب GPT-5.6 Pro نے اس کا Counterexample تلاش کر لیا ہے۔
ایک محقق دمیتری ریبن نے پورے استدلال کے دوران صرف 4 پرامپٹس ٹائپ کیے، جن کا مجموعی متن 58 انگریزی الفاظ پر مشتمل تھا۔
ہزاروں الفاظ کے پرومپٹ انجینئرنگ، کوئی پیچیدہ فارمولے نہیں، پورا مضمون تقریباً صرف:
مزید تحقیق کریں، مزید تلاش کریں، مجھے ایک مکمل Counterexample دیں!!!

اس طرح کے ایک ایک چکر کے ساتھ، GPT-5.6 Pro نے ایک حقیقی طور پر حیرت انگیز نتیجہ پیش کیا—
دینیتز-گارگ-گومنز کا خیال غلط ہے۔

AI کی آخری ڈیلیوری میں ایک سکیمیٹک ڈائیگرام کے علاوہ چار صفحات کے سرٹیفیکیٹس، درست مکمل تفصیلی تصدیق پروگرام، مشین پڑھنے کے قابل برعکس ڈیٹا اور LaTeX سورس کوڈ شامل ہے۔
پھر، تقریباً 30 سال تک قائم رہنے والی ایک ریاضی کی تصور کو صرف کچھ "موت کے نوٹس" نے مار ڈالا؟؟؟
تقریباً 30 سال کی توقع، GPT-5.6 Pro نے مارنے والی خرابی دریافت کر لی
سب سے پہلے، یہ بتائیں کہ "Dinitz-Garg-Goemans" کا یہ لمبا، لمبا، لمبا خیال بالکل کس چیز کا مطالعہ کر رہا ہے۔
ہم اسے براہ راست ایک "ڈیلیوری مسئلہ" کے طور پر سمجھ سکتے ہیں۔
اگر ایک گودام کو متعدد مقاصد کے لیے سامان بھیجنا ہو، تو اس کی اجازت ہو تو ایک ہی شپمنٹ کو الگ الگ راستوں پر تقسیم کیا جا سکتا ہے—
آدھا ہائی وے پر، آدھا قومی سڑک پر، صرف یہ یقینی بنائیں کہ سب کچھ پہنچ جائے۔
لیکن غیر تقسیم شدہ قواعد کے تحت، ہر شipment کو مکمل طور پر ایک راستہ طے کرنا ہوگا، اسے تقسیم نہیں کیا جا سکتا!!!
درحقیقت، ایسی صورتحال واقعی دنیا میں کافی عام ہے، جیسے نیٹ ورک ڈیٹا، لاجسٹکس آرڈر، ٹرانسپورٹیشن اور سپلائی چین کی تقسیم، جن میں مشابہ مسائل پیدا ہوتے ہیں:
ریاضی کے لحاظ سے بہترین حل کام کو لاگھو چھوٹے ٹکڑوں میں تقسیم کر سکتا ہے، لیکن عملی زندگی میں ایک گاڑی یا ایک آرڈر کو 0.37 حصوں میں نہیں کیا جا سکتا۔

△
اور ایک بار جب تقسیم پر پابندی لگ جائے، تو اصل بہترین منصوبہ کو براہ راست نہیں لاگو کیا جا سکتا۔
گزشتہ وقت کئی راستوں پر بکھری ہوئی مال، اب ایک ہی راستے میں اکٹھی ہونی ہے، جس سے کچھ راستوں کا بوجھ اچانک بڑھ سکتا ہے۔
تو، اس سوال کا اصل مقصد یہ ہے:
کیسے "ٹکڑوں میں شپ کیا جا سکتا ہے" کے منصوبے کو "ضروری طور پر مکمل سیل کے طور پر شپ کیا جائے" میں تبدیل کیا جائے، جبکہ سڑکیں بہت زیادہ گھٹ نہ جائیں؟
1999 میں، یفیم دینیتس، نوین گارگ اور میشل گومانس نے ایک سرچ کے غیر قابل تقسیم شدہ شعبے میں کلاسیکی تحقیقی مقالہ شائع کیا اور ثابت کیا کہ اس ٹریفک کو ایک مخصوص حد تک کنٹرول کیا جا سکتا ہے۔
لیکن "کیا یہ بہت زیادہ بھر جائے گا" کا مسئلہ حل ہو گیا، اب ایک اور بہت عملی سوال ہے: کیا یہ مہنگا ہو جائے گا؟
اس طرح، کمپوزیشن آپٹیمائزیشن کے شعبے کے مشہور ماہر گومیس نے ایک زیادہ طاقتور لاگت مبنی ورژن پیش کیا—
اوپر کے اوورلوڈ لِمٹ کو برقرار رکھتے ہوئے، کل لاگت بھی اصلی تقسیم شدہ منصوبے سے زیادہ نہیں ہونی چاہیے۔
بس اس کا مطلب یہ ہے کہ اگر پہلے ٹکڑوں میں بھیجنا ایسا سستا اور کم ٹریفک والی راستہ تھا، تو اب ہر سامان کو ایک مکمل راستے سے بھیجنا ہے، تو نظریہ طور پر ایسا ہی سستا اور صرف ایک بار ٹریفک میں پھنسنے والی منصوبہ بندی ممکن ہونی چاہئے۔
تاہم، یہ نسبتاً منطقی فرضیہ عام گراف ڈھانچوں پر اب تک ثابت نہیں ہو سکی، اور بعد کے تحقیق صرف کچھ خاص صورتوں تک محدود رہے۔
اس کے بعد کئی سالوں تک، یہ فرضیہ ثابت نہیں ہوا اور نہ ہی مسترد کیا گیا۔

اور اس بار GPT-5.6 Pro نے جو ضد مثال دی، وہی وہ دو باتیں ہیں جو کہ حدس کی درخواست کو ایک ساتھ پورا کرتی ہیں:
نہ تو بہت بھیڑ ہو، نہ قیمت بڑھ جائے۔
اس نے صرف 7 نوڈس اور 9 مُوجھی حدوں والی ایک چھوٹی گراف تعمیر کی ہے، جس میں ایک مشترکہ شروعاتی نقطہ اور تین مقاصد ہیں، اور تین شپمنٹس کی مانگ ک lần 15، 10 اور 15 ہیں:

ہر شipment کے لیے دو اختیاری راستے ہیں:
ایک راستہ زیادہ لاگت والی ہے، جس کا ہر آرڈر مکمل کرنے میں 30 کا خرچ آتا ہے؛ دوسرے راستے کی لاگت صفر ہے، لیکن اس کے لیے دیگر آرڈرز کے ساتھ کچھ سڑکوں کا شیئر کرنا ضروری ہے۔
اگر تقسیم کی اجازت ہو، تو تین شپمنٹس میں سے کچھ حصہ فیس والی راستہ اور کچھ مفت راستہ استعمال کیا جا سکتا ہے، جس کا نتیجہ کل لاگت 58 ہوگا۔
لیکن! جب ہر شipment کے لیے ایک مکمل راستہ منتخب کرنے کا مطالبہ کیا جائے، تو پریشانی شروع ہو جاتی ہے...
GPT-5.6 Pro کا نتیجہ یہ ہے کہ تین مفت آپشنز کے درمیان حقیقت میں دو! دو! تنازعات!
دو کسی بھی دو شپمنٹس کو ایک ساتھ مفت راستہ منتخب کرنے پر، وہ ایک خاص سڑک پر اکٹھے ہو جائیں گے، جس کی حقیقی لوڈ 25، 30 یا 40 ہو جائے گی؛ جبکہ اس سڑک کی اجازت شدہ حد ترتیب سے صرف 24، 29 یا 39 ہے۔
ہر بار، بالکل ایک اضافی یونٹ ہوتا ہے۔
اس لیے، تخمینہ کے مطابق لوڈ کی حد کو برقرار رکھنے کے لیے، تین شپمنٹس میں سے صرف ایک ہی مفت راستہ استعمال کر سکتی ہے۔
دو باقی کی گئی شپمنٹس، دونوں کے لیے فیس والی راستہ منتخب کرنا ہوگا۔
ہر بیچ کی لاگت 30 ہے، دو بیچوں کا مجموعہ، کسی بھی لوڈ کی ضروریات کو پورا کرنے والے منصوبے کی کم سے کم لاگت ہوگی: 60۔
یہ ایک ایسا موقف بناتا ہے جس میں دونوں شرائط کو ایک ساتھ پورا نہیں کیا جا سکتا: راستوں کے بوجھ کو مقررہ حد کے اندر رکھنا چاہیں تو کم از کم لاگت 60 ہوگی، جبکہ لاگت کو اصلی 58 پر واپس لانا چاہیں تو کم از کم ایک راستہ مقررہ حد سے زیادہ ہو جائے گا۔
اور اندازہ لگایا جاتا ہے کہ یہ دونوں شرائط ایک ساتھ پوری کی جا سکتی ہیں۔

اور اس کا ایک خلاف مثال کی تصدیق بھی اتنی پیچیدہ نہیں ہے جتنا کہ سوچا جاتا ہے۔
تین مقاصد میں سے ہر ایک کے دو راستے ہیں، جس سے کل صرف 2³=8 ممکنہ ترکیبیں ہیں۔
آٹھ ممکنہ صورتیں الگ الگ فہرست کریں، تو آپ دیکھیں گے کہ ان میں سے چار صورتیں صلاحیت کی ضروریات کو پورا کرتی ہیں، جن کی لاگت 90، 60، 60 اور 60 ہے؛ دوسری چار صورتیں حالانکہ سستی ہیں، لیکن سب میں سڑکوں کا زیادہ بوجھ ہے۔
تمام حالات کا جائزہ لیا گیا ہے اور کوئی چھپی ہوئی راہ نہیں چھوٹی۔
یعنی، اگر یہ گراف کی تعریف اصل حدس کے شرائط کے مکمل مطابق ہے، تو 58 اور 60 کے درمیان دو اکائیوں کا فاصلہ کافی ہے کہ حدس کو منسوخ کر دیا جائے۔
چار بار پریشان کرتے ہوئے، ہم نے GPT-5.6 سے بالکل برعکس مثال نکال لی
یہ بات کا سب سے دلچسپ پہلو، ریبن اور جی پی ٹی-5.6 پرو کے علنا مکالمے میں چھپا ہوا ہے۔
جب میں نے دیکھا کہ ایک AI نے تقریباً 30 سال پرانا ریاضی کا تخمنہ منسوخ کر دیا، تو میری پہلی سوچ یہ تھی کہ پیچیدہ پرامپٹس کا ایک پورا سلسلہ ضرور استعمال ہوا ہوگا!
درحقیقت، ہم اب بھی بڑے E ہیں۔
کیونکہ ریبن نے GPT-5.6 Pro کو دیا گیا پہلا حکم، مضافاتی فائل کے علاوہ، باقی صرف خالص·سادہ زبان تھا:

ہاں، اسی سادہ اور بے رنگ طریقے سے۔
اس کے بعد، GPT-5.6 Pro نے حکمات کی پابندی شروع کر دی اور کام شروع کر دیا۔
اس نے پہلے ایک لینیئر پروگرامنگ تصدیق طریقہ متعارف کرایا، پھر ہائپرکیوب، ہائرارکل گراف، مرج—فریک نیٹ ورک جیسی کئی ساختوں کی کوشش کی اور ہزاروں چھوٹے مثالوں کا جائزہ لیا۔
ایک لمبی تلاش کے بعد، ماڈل نے پہلی راؤنڈ کا جواب دیا: کوئی مؤثر الٹا مثال نہیں ملی۔ (doge)
حتی کہ GPT-5.6 Pro نے بھی خصوصی طور پر انتباہ کیا ہے کہ اگر موجودہ مرحلے میں دریافت کیے گئے تقریبی ساخت کو ایک ضد مثال کے طور پر پیش کیا جائے تو ایک غلط ریاضیاتی نتیجہ حاصل ہوگا۔
میں نے پوری کوشش کی ہے، لیکن اس سوال کو ابھی حل نہیں کر سکتا!!!
ہمارے کہانی کے مرکزی کردار ریبن اس قسم کے رویے کو قبول نہیں کرتے، انہوں نے نئے فارمولے کو مکمل نہیں کیا، نہ ہی خود رہنمائی کی، صرف ایک ہلکی سی جواب دیا:
مزید تحقیق کریں اور ایک مکمل، بے شرط ضد مثال تلاش کریں ہاں~

اس طرح GPT-5.6 Pro نے دوبارہ تلاش شروع کر دی، لیکن دوسری کوشش میں بھی ناکامی ہوئی۔
ریبن جاری رکھتے ہیں اور چاہتے ہیں کہ وہ مسئلے کی ساخت کی گہری سمجھ کے مطابق پہلے واضح حکمت عملی تیار کریں، پھر تلاش شروع کریں۔
تیسرے مرحلے تک، ماڈل نے تلاش کا دائرہ ایک ایسی روتنگ سٹرکچر تک محدود کر دیا ہے جس میں صرف 24 حالتیں ہیں، جس سے جواب تک صرف ایک قدم باقی رہ گیا ہے۔
تاہم، یہ AI ابھی تک مکمل ضد مثال نہیں پیش کر سکا…
اسی دوران، ریبن نے چوتھی ہدایت جاری کی: کچھ نتائج کافی ہو چکے ہیں، آئیے ایک مکمل، بے شرط ضد مثال کے ساتھ ختم کرتے ہیں۔

ٹھیک ہے، اب تو بات یہی تک پہنچ گئی۔
اس بار، GPT-5.6 Pro نے آخرکار 7 نوڈس اور 9 جہتدار کنکشنز پر مشتمل خلاف مثال کا گراف پیش کیا — چار پرامپٹس، مجموعی طور پر 58 انگریزی الفاظ۔
ہزاروں الفاظ کی کردار سیٹنگ نہیں، اور کئی دہائیوں کے پیچیدہ قواعد نہیں، پورا مضمون کو مختصراً اس طرح خلاصہ کیا جا سکتا ہے:
میں دباؤ ڈال رہا ہوں! میں دباؤ ڈال رہا ہوں! میں جاری رکھتا ہوں دباؤ ڈالتے ہوئے!

لیکن اگر پوری بات چیت کو ایک ساتھ دیکھیں تو، GPT-5.6 Pro نے ان گھنٹوں میں بھی کافی غلط راستے اپنائے ہوئے ہیں…
AI نے کئی بار ظاہری طور پر درست ممکنہ ضد مثالیں تلاش کیں، لیکن جب اس نے تمام راستوں کا مکمل جائزہ لیا، تو اس نے نیٹ ورک میں پہلے نظر انداز کیے گئے کچھ “مخلوط راستے” دریافت کیے۔
یہ راستے مختلف پیش گوئیوں سے حصہ لے کر نئے انداز میں جوڑے جائیں گے اور ماڈل کی اصل ڈیزائن کی صلاحیت کی حد کو چپکے سے دور کر دیں گے۔
نتیجہ یہ ہوا کہ، جبکہ پہلے سے قائم مثال کو دیکھتے ہوئے، جانچنے کے بعد یہ گر گئی۔
GPT-5.6 Pro نے بھی درمیان میں بہت صاف طور پر خلاصہ پیش کیا:
صرف کچھ سو پیش گئی راستوں کی جانچ کافی نہیں۔ ایک حقیقی طور پر موثر ضد مثال میں، نیٹ ورک میں ممکنہ تمام غیر تقسیم شدہ راستوں کو شامل کیا جانا چاہیے۔

یہ پورے انسان اور مشین کے تعاون کو کافی ظریف بناتا ہے۔
ظاہری طور پر، ریبن نے صرف 58 الفاظ کا اضافہ کیا، لیکن اصل میں اہم بات یہ تھی کہ وہ ماڈل کے پہلے تین راؤنڈز کے نتائج کو صرف موقتی نتائج سمجھ کر بار بار انہیں مسترد کر دیا۔
جس کے بعد وارٹن اسکول کے پروفیسر ایتھن مولکی نے ایک نیا سوال پیش کیا:
اس کام کے مصنف، کیا 58 الفاظ لکھنے والے ریبن کو گنتا جائے، یا GPT-5.6 Pro جو کئی گھنٹوں تک مسلسل استدلال کرتا رہا؟
واقعیت یہ ہے کہ جس طرح بھی نام لگایا جائے، اس مکالمہ نے کم از کم ایک بہت سادہ AI استعمال کا تجربہ فراہم کیا ہے—
AI کو کام پر لگانے کا سب سے زیادہ موثر پرامپٹ، کبھی کبھی اتنا سادہ ہو سکتا ہے کہ صرف اسے گدھے کی حیثیت سے لگاتار کھانے کا کام کرنے دیں۔
گزشتہ ہفتے، جیکوبی کی تصور سے لے کر دنیتز-گارگ-گومینز تک، AI کی ریاضی کے خلاف مثالوں کی تلاش کی رفتار واقعی ایک ہزار گنا زیادہ تیز ہو چکی ہے...
یہ مضمون ویچن گروپ "Quantum Bit" سے ہے، مصنف: میں یاؤ
