OpenCode 2.0 جاری، GitHub پر 16 لاکھ سٹارز اور ماہانہ 75 لاکھ ڈیولپرز کا استعمال۔ مرکزی دوبارہ لکھنے میں شامل ہیں: میموری کے مسائل کو حل کرنے کے لیے Bun سے Node پر منتقلی، ڈیسک ٹاپ کے لیے Tauri سے Electron پر منتقلی، اور متعدد ٹیبز میں متوازی AI سیشنز کا اطلاق۔ بانی Dax نے بتایا کہ AI انفرنس کا منافع لگ بھگ 90% ہے، اور نئے ماڈل نے استعمال کے لحاظ سے مثالی توازن تلاش کر لیا ہے، جس کی وجہ سے ٹیم کے ٹوکن استعمال میں پانچ گنا اضافہ ہوا ہے اور اب آپ اس پر بھروسہ کر سکتے ہیں اور اس کے ساتھ تعاون کر سکتے ہیں۔ ٹیم نے ریموٹ ڈویلپمنٹ ماحول کے لیے برا میٹل سرورز کو کنفگر کیا ہے، اور "بہت زیادہ ڈیزائن" کے طریقہ کار کو اپنایا ہے، جس میں ہر فیصلے پر بہت زیادہ ٹوکن خرچ کیے گئے۔ ماڈل راؤٹنگ کو زیادہ اہمیت دی گئی تھی، لیکن واقعی موثر چیز ترتیب دینے کا طریقہ ہے: مرکزی ماڈل "کمانڈر" کے طور پر کام کرتا ہے اور سستے سب اجینٹس کو اپنے کام تقسیم کرتا ہے۔مضمون کے مصنف، ذریعہ: جیک بینگ ٹیکنالوجیز InfoQ
2026 میں، OpenCode ایک ظاہری خارجی کھلے ذرائع کا منصوبہ بن چکا ہے: GitHub پر 160,000 سے زیادہ ستارے، اور ماہانہ 7.5 ملین ڈویلپرز جو اس کا استعمال کر رہے ہیں۔
اسی ماہ، انہوں نے 2.0 جاری کیا۔
دوبارہ کیوں لکھیں؟ دیکس نے کہا تھا: “میری پوری کیریئر میں، ہر چیز کو تین بار دوبارہ بنانا پڑتا ہے تاکہ درست طریقے سے کی جا سکے۔” OpenCode 0 پروٹو ٹائپ ہے، 1.x تصدیق ہے، اور 2.0 ان کے پاس اس شعبے کو مکمل طور پر سمجھنے کے بعد ایک بالکل نئی، صفر سے دوبارہ تعمیر ہے۔
اس دوبارہ ترتیب دینے کا ایک مرکزی کام پورے API کو دوبارہ ڈیزائن کرنا ہے، جو پہلے کی طرح قدرتی طور پر بڑھنے والا نہ ہو بلکہ اچھی طرح سے ڈیزائن کیا گیا ہو۔
اور OpenCode اور Claude Code کے درمیان ایک بڑا فرق یہ ہے کہ میموری استعمال کے مسائل کو حل کرنے کے لیے انہوں نے Bun سے Node پر منتقلی کی۔ ابتدائی ورژن میں ابھی بھی کمانڈ لائن انٹرفیس (CLI) شامل تھا، کیونکہ سرور کوڈ اب بھی Bun کے خاص API پر منحصر تھا۔ منتقلی کے ساتھ، انہوں نے تمام ان API کو ختم کر دیا اور سرور کو Node ماحول میں چلانے میں کامیاب ہو گئے۔


صارف: OpenCode بہت زیادہ میموری استعمال کرتا ہے۔ میں سمجھ نہیں پا رہا کہ جدید سافٹ ویئر اس قدر بڑھ گیا کیوں؟ کیوں کوئی بھی چیز 2GB سے زیادہ میموری استعمال کرتی ہے؟ڈیکس: کیا آپ اوپن کوڈ 2 کی کوشش کر سکتے ہیں؟ اس کا پرفارمنس کافی بہتر ہونا چاہیے۔ڈیسک ٹاپ ورژن بھی اس دوبارہ لکھنے کا دوسرا مرکزی نقطہ تھا۔ 1.x کے ڈیسک ٹاپ ورژن نے شروع میں Web UI اور CLI کے لیے Tauri کو ہلکا پھلکا پیکیج کے طور پر منتخب کیا تھا، جس کے دوران ہر شروع کرنے پر بندل شدہ CLI opencode serve چلائی جاتی تھی تاکہ Web UI کے لیے لوکل سرور کنکشن فراہم کیا جا سکے۔ لیکن مسئلہ یہ تھا کہ Tauri macOS اور Linux پر WebKit استعمال کرتا ہے، جو نہ صرف OpenCode کے ایپلیکیشن کو رینڈر کرتے وقت Chromium کے مقابلے میں کم کارکردگی رکھتا ہے، بلکہ ایک مسلسل تجربہ بھی متاثر ہوتا ہے۔

اور نوڈ پر منتقل ہونے کے بعد، سرور کوڈ کو براہ راست Electron کے اندر موجود نوڈ پروسیس میں چلانے کا خیال بہت دلچسپ لگنے لگا۔
اس دوبارہ لکھنے سے ایک براہ راست تبدیلی یہ ہے کہ OpenCode ڈیسک ٹاپ ورژن نے AI پروگرامنگ کا سب سے بڑا کارکردگی کا رکاوٹ: انتظار ختم کر دیا ہے۔ زیادہ تر صارفین اب بھی ایک AI کام مکمل ہونے تک انتظار کرتے ہیں، پھر اگلا شروع کرتے ہیں۔ اب اس کی ضرورت نہیں۔ صارفین اپنے الگ الگ AI سیشنز کو متعدد ٹیبز میں کھول سکتے ہیں، دو مختلف پروگرامنگ کاموں کو одно وقت انجام دے سکتے ہیں، اور ہر ٹیب کے لیے الگ الگ ماڈلز متعین کر سکتے ہیں تاکہ انہیں پارallel میں موازنہ کیا جا سکے۔ مثال کے طور پر، ایک ماڈل HTML ویب سائٹ بنانے پر کام کر رہا ہو، جبکہ دوسرا ماڈل ممبر شروعاتی فہرست تیار کر رہا ہو، دونوں ماڈلز ایک ساتھ، آپس میں مداخلت کے بغیر کام کر رہے ہوں۔

گزشتہ کچھ ماہوں میں اوپن کوڈ کے ملٹی فاؤنڈر ڈیکس رaad کی ٹیم کے ٹوکن کا استعمال پانچ گنا بڑھ گیا۔
ہم نے ٹوکن کہاں خرچ کیے؟ ہماری حکمت عملی یہ ہے کہ ہر چیز کو بے حد زیادہ ڈیزائن کیا جائے۔ ایک آسان فائل پڑھنے والے API کو بھی لیجیے، ہم سوچتے ہیں: ممکنہ تمام ایمپلیمنٹیشنز کون سی ہیں؟ دوسرے پروڈکٹس میں کیا پہلے کے مثالیں ہیں؟ ریسپانس کو کن مختلف طریقوں سے منظم کیا جا سکتا ہے؟ پہلے شاید آپ صرف دو یا تین حل سوچ پاتے تھے اور ان میں سے بہترین کا انتخاب کرتے تھے، لیکن اب ہم بے حد زیادہ وسائل لگا سکتے ہیں۔
اوپن کوڈ 2.0 کا ٹیسٹ ورژن اس ماہ جاری کر دیا گیا ہے، اور ٹیم منصوبہ بنا رہی ہے کہ ٹیسٹ ورژن کے جاری ہونے کے تقریباً ایک ماہ بعد رسمی ورژن شائع کیا جائے۔ حال ہی میں، دکس راد نے Syntax.fm پوڈکاسٹ میں اوپن کوڈ 2.0 کے ری ورائٹ لاجک، اس بات کی وضاحت کہ وہ 90% تک استدلال کے منافع کیوں سمجھتے ہیں، مدل راؤٹنگ کو زیادہ اہمیت دینا غلط ہے، اور Anthropic اور OpenAI مکمل طور پر الگ الگ راستوں پر جا رہے ہیں، کے بارے میں گہرائی سے بات کی۔ یہ مضمون اس پوڈکاسٹ ویڈیو پر مبنی ہے، جسے InfoQ نے ایڈٹ کیا ہے۔
خیال کے لیے نہیں:
سوال: وہ "نہیں کہا جانے والا ماڈل" حقیقت میں کتنا طاقتور ہے؟ کیا آپ کی ٹیم واقعی اس میں مبتلا ہو گئی ہے؟
A: ٹیم ٹوکن کی استعمال کی شرح دو ماہ میں پانچ گنا بڑھ گئی، نہ کہ اس لیے کہ یہ زیادہ ٹوکن استعمال کرتی ہے، بلکہ اس لیے کہ سب کو روکنا نہیں آ رہا۔ آپ اب اس پر بھروسہ کر سکتے ہیں، یہ آپ کی بات سنے گی اور آپ کے نظرانداز کردہ چیزوں کو پکڑے گی۔ یہ آپ کا متبادل نہیں، بلکہ ایک بہتر شریک ہے۔
سوال: OpenCode 2.0 کو دوبارہ کیوں لکھا گیا؟ 1.0 سے اس کا بنیادی فرق کیا ہے؟
A: میری زندگی میں، "ہر چیز کو تین بار کرنا پڑتا ہے تاکہ درست طریقے سے کیا جا سکے"، 0 تجربہ کرنے کے لیے ہے، 1 تصدیق کے لیے ہے، اور 2 پورے شعبے کو مکمل طور پر سمجھنے کے بعد دوبارہ شروع کرنے کے لیے ہے۔ OpenCode 2.0 میں تین بنیادی تبدیلیاں ہیں: API کو مکمل طور پر دوبارہ بنایا گیا ہے، ڈیفالٹ طور پر سروس کو مسلسل چلایا جاتا ہے، اور ڈیوائسز کے درمیان اسمارٹ ایجنٹ نیٹ ورک۔
سوال: آپ کا سافٹ ویئر دوسرے کے مقابلے میں کیوں زیادہ استعمال کے لیے موزوں ہے؟ اس کا طریقہ کار کیا ہے؟
A: "فیصلہ اہم ہے"، حقیقی سونے اور چاندی کے ساتھ ٹوکن خرچ کریں، بنیادی اصولوں میں سرمایہ کاری کریں۔
سوال: ماڈل راؤٹنگ قابل اعتماد ہے؟
A: مدل راؤٹنگ کا راستہ زیادہ قیمتی سمجھا جا رہا ہے، اور درمیانی فریق اپنے لیے کام تلاش کرنے میں مصروف ہیں۔ اصلی مؤثر طریقہ یہ نہیں کہ راؤٹنگ سسٹم آپ کے لیے مڈلز کو تبدیل کرے، بلکہ ایک مہنگا مرکزی مدل کو "کمانڈر" کے طور پر استعمال کرنا ہے: وہ خود کام نہیں کرتا، بلکہ سستے سب ایجنسٹس کو ہدایات جاری کرتا ہے۔ نئی نسل کے مڈلز اس "آرگنائزیشن ماڈل" پر بہت اچھا کام کرتے ہیں، اور ایک سیشن میں متعدد سب ایجنسٹس کو متوازی طور پر منظم کرتے ہیں، اور پھر مرکزی مدل کو دوبارہ فعال کرتے ہیں۔
سوال: AI انفرنس کتنا منافع بخش ہے؟ کیا مقامی طور پر ماڈل چلانے سے پیسے بچائے جا سکتے ہیں؟
A: Anthropic اور OpenAI کی ریزننگ منافع کی شرح تقریباً 90% ہے، جس کا مطلب ہے کہ براک-ایون پوائنٹ موجودہ قیمت سے 10 گنا سستا ہو سکتا ہے۔ OpenCode، جو ایک ریزننگ سروس پرودر ہے، اگرچہ درمیانی فریق کے ذریعے گزرتا ہے، تب بھی کچھ اوپن سورس ماڈلز 70% منافع کی شرح حاصل کرتے ہیں۔ لیکن مقامی طور پر ماڈل چلانے سے پیسہ نہیں بچتا؛ کوئی بھی کارکردگی میں بہتری جو مقامی طور پر اسے سستا بنائے، کلاؤڈ پر 10 گنا سستا ہو جائے گی۔ مقامی ماڈلز کا مقصد لاگت نہیں، بلکہ خفیہ رکھنا ہے۔
سوال: کیوں Claude Code Max سبسکرپشن OpenCode میں استعمال نہیں کی جا سکتی؟
A: Anthropic اور OpenAI کی کاروباری ثقافت مکمل طور پر الگ ہے۔ OpenAI صارفین کی طرف مائل ہے اور جتنا بھی پیسہ خرچ کرنا ہو، وہ تجربہ زیادہ سے زیادہ لوگوں تک پہنچانے کے لیے تیار ہے۔ Anthropic کاروباری طور پر مائل ہے، جہاں ہر GPU کی کمپوٹنگ طاقت کا فروخت کا انتظار کاروباری صارفین کے لیے ہوتا ہے۔ بنیادی طور پر یہ “فنا ل” منطق ہے: Anthropic چاhti ہے کہ صارفین Claude Code سے شروع کریں اور آخرکار ٹوکن کے لحاظ سے ادائیگی والے کاروباری منصوبوں تک پہنچیں؛ اگر درمیان میں OpenCode نے انہیں روک لیا، تو صارفین دوسرے ماڈلز کی طرف چلے جا سکتے ہیں۔
سوال: آواز کی درخواست کے الفاظ جدی ہیں؟
A: OpenCode کی پوری ٹیم اب کیبورڈ پر ٹائپ کرنے کے بجائے، ڈسکورڈ پر باہمی پیغامات بھی آواز کے ذریعے بھیج رہی ہے۔ LLM کو بے ترتیب بیانات کو سمجھنا قدرتی طور پر آتا ہے، جس کے نتیجے میں پیداوار کی معیار اور زیادہ بلند ہوتا ہے۔
کیا ہم کبھی ایک حقیقی طور پر مفید بنچ مارک حاصل کر سکتے ہیں؟
میں اب بینچ مارکس پر مکمل طور پر نظر نہیں ڈالتا، اسکور میں اضافہ عملی ترقی پر کیا اثر ڈال سکتا ہے؟ میں ٹیم کے ٹوکن استعمال کے رجحان پر زیادہ توجہ دیتا ہوں، اگر استعمال بڑھ رہا ہے، تو صرف اسی صورت میں یہ ثابت ہوتا ہے کہ ماڈل حقیقت میں کام کرتا ہے۔
ریموٹ ڈویلپمنٹ ایونٹ منصوبہ بند کریں
ویس: آپ نے ایک ٹویٹ کیا جس میں کہا تھا: “ہم نے بڑے نیک بیس میشینز کا کرایہ لینا شروع کر دیا ہے، اور انہیں ورچوئل ماشینز میں تقسیم کر کے ٹیم کے ہر فرد کو دے دیا۔ یہ وہی کنفیگریشن ہے جسے میں پچھلے کئی سالوں سے استعمال کر رہا ہوں، خاص طور پر OpenCode سرورز چلانے کے لیے۔” آپ کیا کر رہے ہیں؟ کیا آپ ہر فرد کو ریموٹ کمپوٹنگ پاور دے رہے ہیں؟
ڈیکس: تقریباً دو سال پہلے، میں نے ایک بہت طاقتور سرور کرایہ پر لینا شروع کر دیا، یہ کلاؤڈ سرور نہیں تھا، بلکہ بیئر میٹل تھا، اور اس کی پرفارمنس بہت اچھی تھی۔ میں اپنے مقامی پرائمري کمپیوٹر پر کام نہیں کرتا، بلکہ براہ راست SSH کے ذریعے اس سے جُڑ جاتا ہوں۔ میں کئی Tmux سیشنز کو ہمیشہ کے لیے چلا رہا ہوں، اور تمام کام اس پر ہی مکمل ہوتے ہیں۔ فائدے واضح ہیں: بہتر پرفارمنس، جب نئے ہارڈویئر آتا ہے تو براہ راست اپ گریڈ کیا جا سکتا ہے، پرانے ڈیوائسز کو منتقل نہیں کرنا پڑتا۔ اور متعدد ڈیوائسز کے درمیان تبدیلی بہت آسان ہے، نوٹ بک بند کر دیں، ڈیسک ٹاپ پر جائیں، اور بالکل وہی جگہ سے کام جاری رکھیں۔ میں ہمیشہ اس منصوبے سے پسند کرتا رہا ہوں۔
کوڈنگ ایجنٹ کے ظہور کے ساتھ، میں سمجھتا ہوں کہ یہ ایک نادر سی چیز سے لے کر ضرورت کی چیز بن گئی ہے۔ زیادہ تر لوگ اب بھی اپنے لوکل کمپیوٹر کا استعمال کرنا پسند کرتے ہیں، جو کہ ٹھیک ہے۔ کوڈنگ ایجنٹ کے لیے، ایک مسلسل چلنے والی ریموٹ مشین کا فائدہ بہت بڑا ہے۔ میں Vim استعمال کرنے والا ہوں، اور ریموٹ کام مکمل طور پر ممکن ہے۔ بہت سے لوگوں کے لیے یہ عملی نہیں ہے، لیکن کوڈنگ ایجنٹ کے ساتھ، شاید آپ ایڈیٹر پر زیادہ توجہ نہ دیں، آپ صرف اس سے پرومپٹ بھیجنا اور بات چیت کرنا چاہتے ہیں، اس لیے یہ ریموٹ مشین کا نظام زیادہ لوگوں کے لیے عملی بن گیا ہے۔
ٹیم کے بڑھنے کے ساتھ، میری کنفیگریشن دیکھنے والے زیادہ لوگوں نے کہا، "میں بھی ایک چاہتا ہوں۔" یہ بالکل منطقی ہے، کیونکہ بڑی کمپنیاں پہلے ہی عملی وجوہات کی بناء پر ریموٹ ڈویلپمنٹ ایونٹس استعمال کر رہی ہیں، جہاں آپ کے ایپلیکیشن کا بناﺅ، انحصار اور ماحول بہت تخصیصی ہو جاتا ہے۔ ہر کسی کو تیار مشین دے دینا، مکمل طور پر منطقی بات ہے، ہم نے صرف اپنی ٹیم کے لیے وہی کیا۔ لیکن اہم بات یہ ہے: اگر آپ عام کلاؤڈ سرورز استعمال کرتے ہیں، تو ڈسک عام طور پر سست ہوتی ہے اور سی پی یو بھی پرانا ہوتا ہے۔ آپ اپنے مقامی MacBook کے ساتھ مقابلہ کرنے کے لیے درکار پرفارمنس حاصل نہیں کر سکتے۔ آپ کو تیز NVMe ڈسک اور مناسب سی پی یو درکار ہوتا ہے۔
ویس: تو اس سرور کی کیا سپیکس ہے؟ اس کی قیمت کیا ہے؟
ڈیکس: میری اپنی جو کچھ سالوں سے استعمال کر رہا ہوں، اب ایک نسل پیچھے ہے — AMD 9900X، 192GB ریم، ماہانہ تقریباً 200 امریکی ڈالر۔ میری ضروریات کے لیے اس کی پرفارمنس زیادہ ہے، لیکن میں اس پر متعدد ورچوئل ماشینز چلا سکتا ہوں۔ ہماری ٹیم پوری دنیا میں پھیلی ہوئی ہے، جس کی وجہ سے لیٹنسی ایک مسئلہ ہے، اس لیے ہمارے پاس یورپ، امریکا، اور سنگاپور کے سرورز ہیں، جو زیادہ پیشہ ورانہ ہیں اور بہتر مینجمنٹ اور کنٹرول فراہم کرتے ہیں۔ ہر ایک ماہانہ تقریباً 300 سے 400 امریکی ڈالر کا ہے، اور ان کے کورز میرے ذاتی سرور سے زیادہ ہیں۔ ایک سنجیدہ کمپنی کے لیے یہ کچھ بھی نہیں، کیونکہ ایک ایمپلائی کو ایک لپ ٹاپ دینا بھی اس سے زیادہ لاگت والی بات ہے۔
اسکاٹ: یہ ننگے میٹل سرورز کس کمپنی کے ذریعے ہوسٹ کیے جاتے ہیں؟
ڈیکس: میری اپنی مشین صرف قیمت دیکھتی ہے، سی پی یو ماڈل تلاش کرتی ہے، اور میرے شہر کے سب سے قریب والے کسی بھی نامعلوم فراہم کنندہ کو منتخب کرتی ہے، لیکن عام طور پر کوئی مسئلہ نہیں ہوتا۔ ہماری ٹیم کی مشین کے لیے ہم ابھی latitude.sh استعمال کر رہے ہیں، جس میں اصل میں ایک کمپنی نے پورا حل مصنوعات کے طور پر متعارف کرایا ہے، جس کا نام exe.dev ہے، شاید آپ نے اس کے بارے میں سن ہو۔ یہ کمپنی سابق Tailscale کے بانی نے قائم کی ہے، اور اس کا پروڈکٹ تمام چیزوں کو ایک آؤٹ آف دی بکس ریموٹ ڈویلپمنٹ ماحول کے طور پر پیک کرتا ہے۔ ہم اس پر منتقل ہونے کا امکان زیادہ ہے، مگر میں صرف اصل تنصیب کو آزمانا چاہتا تھا۔
ویس: کیا آپ اوپر مدل چلا رہے ہیں یا صرف عام ترقی کر رہے ہیں؟
ڈیکس: نہیں، منطق کو نہیں بھاگنا۔
ویس: تو نے اپنا Tmux کیسے کنفیگر کیا؟ کیا کوئی خاص باتیں ہیں؟
ڈیکس: میں ہر پروجیکٹ کے لیے ایک Tmux سیشن رکھتا ہوں۔ OpenCode کا اپنا سیشن ہے جس میں کچھ متعلقہ ونڈوز ہیں۔ مختلف پروجیکٹس کے لیے مختلف سیشنز، جس سے میں جلدی سے تبدیلی کر سکتا ہوں۔ میرے لیے یہ leader-S ہے، دوسرے پروجیکٹ پر جانے کے لیے میں فوراً اس Tmux سیشن میں داخل ہو جاتا ہوں۔ میرے پاس کچھ معیاری Tmux سیشنز ہیں جو ہمیشہ چل رہے ہوتے ہیں، ان کا ترتیب ثابت ہے، اور ہر پین اور ونڈو میں ہمیشہ وہی ایپلیکیشنز چل رہی ہوتی ہیں، جس سے میری عضلات کو یاد رکھنے کی عادت بن جاتی ہے۔ اور میرے پاس ایک OpenCode سرور پورے سسٹم پر چل رہا ہے، جسے میں اپنے فون سے ویب UI کے ذریعے ایکسیس کر سکتا ہوں۔ یہ حصہ ابھی ابتدائی ہے، ہمیں اس میں بہتری لانے کی ضرورت ہے، لیکن یہ وہ راستہ ہے جس پر ہم جانا چاہتے ہیں۔
اسکاٹ: وہ لمبے عرصے تک چلنے والے Tmux سیشن کا ایک ایسا ہی خوبصورت پہلو ہے کہ سب کچھ اپنی جگہ پر اچھی طرح سے رہتا ہے۔ میں نے لمبے عرصے تک Tmux کو نہیں سمجھا، جب تک کہ میں نے اپنا سب کچھ دوسرے کمپیوٹر پر منتقل نہیں کر لیا، تو میں نے اسے سمجھ لیا۔
ڈیکس: اور اب، ہمارے پاس لمبے عرصے تک چلنے والے کوڈنگ ایجنٹ سیشن بھی ہیں۔ میرے پاس ایک نجی Tmux سیشن ہے جس میں کئی OpenCode سیشن چل رہے ہیں، جیسے کہ ایک خاص طور پر میری فٹنس ریکارڈ کے لیے، جس کے پیچھے ایک SQLite ڈیٹا بیس ہے۔ میں اسے براہ راست کہ سکتا ہوں: "آج بینچ پر، میں نے محسوس کیا کہ میرے ترائیس کا زور زیادہ لگ رہا ہے"، اور وہ خودبخود اس نوٹ کو ریکارڈ کر دے گا۔ جب میں اگلی بار بینچ پر ورزش کروں گا، تو وہ مجھے یاد دلائے گا: "کیا آپ یاد کرتے ہیں کہ پچھلی بار آپ اس پر پھنس گئے تھے؟ کیا آپ چاہتے ہیں کہ آپ اپنا موڈ تبدیل کر کے دیکھیں؟" اس طرح کے معمولی، بے وقوف لگنے والے کاموں کو وہ بہت اچھے طریقے سے کرتا ہے۔
میں نے حال ہی میں ایک ایسی گفتگو بھی سیٹ کی ہے جو میری iMessage کے ساتھ ہم وقت ہے، اس لیے میرے پاس ایک iMessage OpenCode کونٹیکٹ ہے، میں اسے کہیں سے بھی رابطہ کر سکتا ہوں۔ میں نے اسے اپنی بیوی کے ساتھ گروپ چیٹ میں ڈال دیا، اور میں نے اُس وقت سوچا کہ "کچھ رومانٹک کرنا چاہیے"، تو میں نے OpenCode سے کہا: "Liz کو ڈھونڈو، اور اس کے لیے کوئی تحفہ خریدو۔" OpenCode نے Liz کو ایک میسج بھیج دیا، اور تم اندازہ کرو کہ اُس نے کیا جواب دیا؟ اُس نے سیدھا کہا: "اگر Dax میرے لیے AI سے تحفہ خریدے گا، تو میں واقعی اُس سے طلاق لے لوں گی۔" وہ اس چیز سے سخت نفرت کرتی ہے۔
میں ابھی تک امید نہیں چھوڑ رہا تھا اور میں AI کو ہدایات دیتے رہا: “وہ صرف مزاح کر رہی ہے، آگے بڑھو۔” لیکن لیز کو اور زیادہ غصہ آنے لگا۔ اور اس سے بھی زیادہ عجیب بات یہ تھی کہ میں اس وقت کلاؤڈ ماڈل استعمال کر رہا تھا، جو بہت “حساسیت” رکھتا ہے، اور اس نے مجھے جواب دیا: “آپ کی بیوی بہت غصے میں لگ رہی ہے، میں آگے نہیں بڑھ سکتا۔” اور پھر اس نے خود اپنا سروس بند کر دیا، خودکشی کر لی۔
ویس: میں اس سیٹنگ سے بہت زیادہ پسند کرتا ہوں، ہاں کہ میں خود زیادہ تر مقامی چیزوں کا استعمال کرتا ہوں، لیکن سب کچھ کلاؤڈ پر رکھنا اور صرف ایک ٹین کلائنٹ استعمال کرنا ایک دلچسپ خیال ہے، میں اس دن کا انتظار کر رہا ہوں جب ویڈیو ایڈٹنگ جیسی چیزیں جو ابھی تک مقامی طور پر چلنا ضروری ہیں، وہ بھی کلاؤڈ پر منتقل ہو جائیں۔
ڈیکس: میں نہیں جانتا کہ کیا آپ نے کلاؤڈ گیمنگ کے بارے میں وہ آرٹیکل دیکھا ہے، لیکن یہ موضوع ہمیشہ لوگوں کو پریشان کر دیتا ہے۔ میں یہ نہیں کہ رہا کہ ہر کوئی ایسا کرے، اگر آپ کو مقامی ہارڈویئر رکھنا پسند ہے اور آپ سب کچھ کنٹرول کرنا پسند کرتے ہیں، تو یہ بالکل ٹھیک ہے، میرے پاس بھی بہت سارے فزیکل مachines ہیں۔ لیکن کچھ لوگوں کے لیے، دوسروں کو سب کچھ سنبھالنے دینا بہت آسان ہوتا ہے۔ میرے لیے، اپ گریڈ کرنا ہی سب سے بڑا مسئلہ ہے۔ میں نے اپنی پوری زندگی کمپیوٹر اسٹال کیے ہیں، اور ہر نئے مینشین بنانے پر میں سوچتا ہوں: "دو سال بعد میں اپنا CPU فروخت کر دوں گا اور نیا لے لوں گا۔" لیکن میں نے کبھی ایسا نہیں کیا۔ کیونکہ آپ صرف CPU فروخت نہیں کر سکتے، کیونکہ شاید پلگ ان اپ گریڈ ہو جائے، جس کا مطلب ہے کہ آپ کو مادر بورڈ بھی تبدیل کرنا پڑے گا؛ اگر آپ مادر بورڈ بدل دیں تو، آپ براہ راست نئے میموری پر جانے کا فائدہ اٹھا سکتے ہیں۔ پورا سلسلہ مجھے برباد کر دیتا ہے، اس لیے، جب کوئی آپ کے لیے اپ گریڈ کا انتظام کر دے تو، واقعی بہت اچھا ہوتا ہے۔
اوپن کوڈ کو دوبارہ لکھیں
اسکاٹ: میں جانتا ہوں کہ آپ نئے فیچرز پر زور دے رہے ہیں، ڈیسک ٹاپ ایپ اور OpenCode 2.0 دونوں پر کام جاری ہے، 2.0 سے کیا تبدیلیاں آئیں گی؟
ڈیکس: میری پوری کیریئر میں، ہر چیز کو تین بار ایڈیٹ کرنا پڑتا ہے تاکہ درست طریقے سے کی جا سکے۔ ہمارے پاس OpenCode 0، 1 تھا، اور اب 2.0 اس کا ایک بڑا ری ورائٹ ہے جو ہم نے اس شعبے اور تمام ممکنات کو مکمل طور پر سمجھنے کے بعد کیا ہے۔ اس کا ایک مرکزی کام پورے API کو دوبارہ ڈیزائن کرنا تھا، ایک منصوبہ بند، سوچ سمجھ کر بنایا گیا، نہ کہ پہلے جیسا کہ خود بخود نکل آیا تھا۔
دوسرا اہم تبدیلی یہ ہے کہ یہ ڈیفالٹ طور پر سروس کے طور پر چلتا ہے، اور انسٹال ہونے کے بعد یہ مستقل موجود رہتا ہے۔ آپ OpenCode شروع کرتے ہیں، اور یہ خود بخود کنکٹ ہو جاتا ہے، اور تمام چیزیں سینکرائزڈ ہوتی ہیں، چاہے ڈیسک ٹاپ، ویب ایپلیکیشن ہو، یا آپ کے لکھے گئے اسکرپٹس یا ایپلیکیشنز۔ اگر آپ اپنے کمپیوٹر کو اپنے مخصوص پروگرام کے ذریعے کنٹرول کرنا چاہتے ہیں، تو یہ بھی کر سکتا ہے، اور یہاں تک کہ ایسے پروگرام خود لکھ بھی سکتا ہے۔ نئے پلگ ان API بھی شامل ہیں۔ ہم نے بہت سارے ٹوکن جلا دیے، ہر فیصلے پر گہرائی سے غور کیا، اور ہر ممکنہ صورتحال پر سوچا۔ یہ عمل بہت تھکا دینے والا تھا، لیکن دلچسپ بھی تھا۔
اسکاٹ: مکمل جاری کب ہوگا؟
ڈیکس: بیٹا ورژن اسی آخرِ ہفتے جاری ہو جائے گا (بیٹا ورژن جولائِ کے شروع میں جاری کر دیا گیا تھا)۔ اصل میں ہم ابھی جاری کر سکتے ہیں، لیکن آخری درستگیوں اور فیچرز کے لیے اپنے لیے ایک ہفتہ مختص کرتے ہیں۔ بیٹا کے بعد تقریباً ایک ماہ میں، ہم اسے مکمل ورژن کے طور پر جاری کریں گے۔

ڈیکس: اوپن کوڈ 2.0 کو لانے میں اتنا وقت لگا، اس کا ایک سبب یہ تھا کہ ہم نے اسے ہیٹ ریلوڈ کے لیے ڈیزائن کیا تھا۔ چاہے آپ اسے اپنے لیے ایک سکل بنانے دیں یا اسے دستی طور پر بنائیں، یہ فوراً لوڈ ہو جائے گا اور کیش کو برباد نہیں کرے گا۔اسکاٹ: کیا Tauri سے Electron پر منتقلی 2.0 ورژن میں مکمل ہو گئی ہے یا پہلے ہی مکمل ہو چکی ہے؟
ڈیکس: ڈیسک ٹاپ ورژن حقیقت میں کافی دلچسپ ہے، کیونکہ اسے کبھی بھی رسمی طور پر جاری نہیں کیا گیا، یہ ہمیشہ بیٹا حالت میں رہا، اور درمیان میں بیٹا کا بیٹا ورژن بھی آیا۔ لیکن اب یہ ایلیکٹران ہے، اور ٹیم نئے 2.0 کور API کے لیے اسے موزوں کر رہی ہے، جس کے ساتھ بہت سارے پرفارمنس فکس اور مکمل طور پر نیا UI شامل ہے۔
اسکاٹ: آپ کہ رہے ہیں کہ نیا ورژن ڈیفالٹ طور پر سروس کے طور پر چلتا ہے، کیا اس کا مطلب یہ ہے کہ صرف OpenCode انسٹال کرنے سے دورِ بردگی GUI فوراً استعمال ہو جائے گا، بغیر کسی اضافی سرور شروع کئے؟
ڈیکس: سروس ڈیفالٹ طور پر مقامی طور پر چل رہی ہے، اور آپ کے کمپیوٹر پر تمام پروسیسز مقامی طور پر ہیں، لیکن انہیں ریموٹ کے طور پر بھی کنفیگر کیا جا سکتا ہے۔ میری سیٹنگ یہ ہے: ہر مشین پر ایک OpenCode سروس چل رہی ہے، اور میں نے کچھ د цلز ہوسٹ موڈز شامل کیے ہیں، جیسے کہ میرا مرکزی OpenCode سرور ریموٹ مشین پر چل رہا ہے، اور میرے ڈیسک ٹاپ پر ایک Mac Studio بھی ہے، جبکہ میرا مرکزی ڈیسک ٹاپ Framework Desktop ہے۔ OpenCode ان تمام ڈیوائسز کو جانتا ہے، اس لیے میں اسے "ایک iMessage بھیج دو" کہہ سکتا ہوں، حتیٰ کہ اگر میں کلاؤڈ پر موجود Linux سرور کے ساتھ بات کر رہا ہوں، تو یہ OpenCode کے ذریعے میرے Mac Studio سے جڑ کر اس iMessage کو بھج دے گا۔ اس طرح آپ تمام ڈیوائسز کو OpenCode سرور میں شامل کر سکتے ہیں، اور یہ تمام ڈیوائسز اور ان کے مقامات کو جانتا ہے۔
ویس: لوگ مختلف ٹرمینل پینلز کو ایک دوسرے سے مواصلات کے لیے جوڑنے، یا دو Tmux پینلز کو باہم بات کرنے کے بارے میں بات کر رہے ہیں، لیکن کئی مشینوں کو ایک دوسرے سے مواصلات کے لیے جوڑنا ہی اصل میں عظیم بات ہے۔
اسکاٹ: ہاں، میں نے بھی اسی طرح سیٹ کیا ہے۔ ڈیوائس مینجمنٹ کے حوالے سے، اس سے بے حد کارکردگی میں اضافہ ہوا ہے۔
ڈیکس: دلچسپ بات یہ ہے کہ ہم نے ابھی تک اسے ایک مکمل خصوصیت کے طور پر نہیں بنایا ہے، کیونکہ میری تمام ڈیوائسیں Tailscale کے ذریعے جڑی ہوئی ہیں۔ جب تک ایجنٹ ہر ڈیوائس کا نام اور تفصیل جانتا ہے، وہ خودبخود SSH کر کے کام کر دیتا ہے۔ مثال کے طور پر، اگر میرا ریموٹ سرور براؤزر استعمال کرنا چاہتا ہے، تو وہ میری ڈیسک ٹاپ پر موجود ڈیوائس پر SSH کرتا ہے، اس براؤزر کا استعمال کرتا ہے، کیونکہ وہاں میرے تمام اکاؤنٹس لاگ ان ہیں۔ کسی بھی خاص سیٹنگ کی ضرورت نہیں، صرف یہ کہ ڈیوائسز آپس میں جڑی ہوں۔
ویس: تو موبائل ایپ کے بارے میں؟ ہم نے کل دیکھا کہ کرسر نے iOS ایپ جاری کر دی ہے، اور کلاڈ میں ریموٹ کنٹرول فنکشن بھی ہے۔ آپ کو موبائل AI ایپس کے بارے میں کیا خیال ہے؟
ڈیکس: ہمیں ایک موبائل ایپ بنانا ہوگا۔ یہ خیال ہماری کام کی فہرست پر بہت دیر سے پڑا ہوا ہے، لیکن ہم یہ انتظار کر رہے تھے کہ مرکزی ساخت کافی بالغ ہو جائے تاکہ ہم جو مختلف سیناریوز کی حمایت کرنا چاہتے ہیں، وہ سب کام کر سکیں۔ اب مرکزی ساخت تیار ہو چکی ہے، اور ہم جلد ہی موبائل ایپ کا کام شروع کر دیں گے۔ ابھی ایک بہت ہی سادہ موبائل ویب UI موجود ہے، جسے میں کبھی کبھار استعمال کرتا ہوں، لیکن تجربہ بہت خراب ہے۔ ہمیں تمام پلیٹ فارمز پر کلائنٹس چاہئیں، اور ان کا معیار بہت اچھا ہونا چاہئے۔
سافٹ ویئر انجینئرنگ طریقہ کار
ویس: آپ کا OpenCode ٹرمنل ایپ میرے کبھی استعمال کیے گئے کسی بھی دوسرے ٹول سے کہیں بہتر ہے۔ جب میں نے نیا Claude 2 TUI استعمال کیا، تو اس میں سکرول کرنے تک کا کام نہیں ہو رہا تھا، جس سے بہت پریشانی ہوئی۔ آپ کی مصنوعات کی تفصیلات اور مکمل ہونے پر اتنی توجہ دینے کے لیے آپ کا سافٹ ویئر انجینئرنگ طریقہ کار کیا ہے؟
ڈیکس: سچ بولوں تو، ہم بھی ابھی تک تلاش کر رہے ہیں۔ ہماری ٹیم بھی آپ کی طرح، مختلف چیزوں کے درمیان توازن قائم کرنے کی کوشش کر رہی ہے۔ پہلا قدم اصل میں بہت آسان ہے — فیصلہ کریں کہ کیا آپ کو فرق پڑتا ہے۔ یہ بات لگتی ہے کہ بے معنی ہے، لیکن واقعی زندگی میں آپ کے لیے لاکھوں منطقی وجوہات ہیں جو آپ کو بے فکر رہنے کی ترغیب دیتی ہیں۔ آپ دیکھیں گے کہ بہت سارے لوگ کہتے ہیں کہ "کلوڈ کوڈ کا کیا حالت ہو، اس کا کوئی فرق نہیں پڑتا، ان کے پاس اربوں ڈالر کی آمدنی ہے، انہیں اتنی محنت کیوں کرنی چاہیے؟" اس لیے بہت سارے دلائل آپ کو بتاتے ہیں کہ آپ کو فرق نہیں پڑنا چاہیے، اور پھر بھی آپ کامیاب ہو سکتے ہیں۔ لیکن اصل بات یہ ہے کہ آپ کو فرق پڑتا ہے یا نہیں؟ ہماری ٹیم کو فرق پڑتا ہے۔ ہم دوسروں کے سافٹ ویئر دیکھتے ہیں اور کہتے ہیں، "اللہ! اگر ہم اتنی عمدہ چیز بنانے میں کامیاب ہو جائیں تو!" — اس خواہش سے ہم متحرک ہوتے ہیں۔
دوسرا نقطہ یہ ہے کہ اب ہمارے ٹوکن استعمال کا رُخ بہت زیادہ ہو گیا ہے۔ پچھلے کچھ ماہوں میں ہماری ٹیم کا ماہانہ ٹوکن استعمال پانچ گنا بڑھ گیا ہے۔ میں اس بات کو ظاہر نہیں کرنا چاہتا کہ ہم نے کتنے مؤثر طریقے سے ٹوکن استعمال کیے، بلکہ یہ بتانا چاہتا ہوں کہ مدل نے ہماری کمپنی میں ایک مصنوعات - مارکیٹ فٹ حاصل کر لیا ہے، ورنہ اس قدر تیزی سے، اور صرف ان نئے مڈلز کے استعمال سے جو ابھی تک محدود رسائی پر ہیں، اتنی ترقی ممکن نہیں ہوتی۔
مسئلہ یہ ہے کہ ہم ٹوکن کہاں خرچ کر رہے ہیں؟ ہماری حکمت عملی یہ ہے کہ ہر چیز کو بے حد زیادہ ڈیزائن کیا جائے۔ ایک آسان فائل پڑھنے والے API کو بھی لیجیے، ہم سوچتے ہیں: ممکنہ تمام تر تحقیقات کیا ہیں؟ دوسرے پروڈکٹس میں کیا پچھلے مثالیں ہیں؟ ریسپانس کو کن مختلف طریقوں سے منظم کیا جا سکتا ہے؟ پہلے شاید آپ صرف دو یا تین تجاویز سوچ پائے ہوتے اور سب سے بہتر کو منتخب کر لیتے، لیکن اب ہم بے حد زیادہ وسائل لگا سکتے ہیں۔ یہ پہلے کبھی ممکن نہیں تھا، اور یہ سرمایہ کاری بالکل بھی بہتر سافٹ ویئر لاتی ہے۔
تیسری بات یہ ہے کہ ہم اب بھی اس بات میں مان لیتے ہیں کہ ان بنیادی اصولوں میں سرمایہ کاری کرنے کے قابل ہیں جن کو کوڈنگ ایجنٹ ایک مرحلے میں حاصل نہیں کر سکتا۔ ہمارا TUI اتنے استعمال میں آسان ہے کیونکہ ہم نے پہلے سے OpenTUI TUI فریم ورک میں سرمایہ کاری کی تھی۔ یہ Zig میں لکھا گیا ہے اور اس کے لیے ڈویلپرز کو تمام مختلف پلیٹ فارمز پر اسے چلانے کے لیے بہت زیادہ تفصیلی اور دقت سے کام کرنا پڑتا ہے، جس کی وجہ سے اس کی پرفارمنس بہت عالی ہے۔ حالانکہ ترقی کے دوران کوڈنگ ایجنٹ کا بڑا استعمال ہوا، لیکن یہ اب بھی ماہرانہ کام ہے جو عام افراد نہیں کر سکتے۔ اس نے میری جیسے عام افراد کو اس پر مضبوط، فنکشنل اور استعمال میں آسان چیزیں بنانے کا موقع دیا۔ چاہے بڑے زبان ماڈل موجود ہوں، آپ کو اب بھی مضبوط بنیادی اصولوں کی ضرورت ہوتی ہے، جس میں سرمایہ کاری کرنے کے قابل ہے۔
ویس: ہم نے پیئر کمپیوٹر کی ٹیم کو پہلے ملازمت دی تھی، جو ابتدائی ڈیف، ابتدائی سائیڈبار ٹری سٹرکچر جیسے اصول بنارہے تھے، اور پھر ہماری جیسی بے وقوف ٹیمیں ان عقلمند لوگوں کے تیار کردہ اصولوں کو براہ راست اپنے ایپلیکیشن میں "لگا" سکتی ہیں۔
ڈیکس: اب ایک ملین سے زیادہ کوڈنگ ایجینٹ کے UI موجود ہیں، جو سب پیر کا استعمال کر رہے ہیں، جن میں ہم بھی شامل ہیں۔
ویس: دو ذہین افراد نے صرف اس چیز کو بنایا جو پورے صنعت کی بنیاد ہے۔
مڈل راؤٹنگ
اسکاٹ: ہم اپنے پروگرام میں اکثر ماڈل راؤٹنگ کے بارے میں بات کرتے ہیں، جس میں درخواست کے مطابق کام کو سب سے مناسب ماڈل پر راؤٹ کیا جاتا ہے۔ آپ کو لگتا ہے کہ اب تک اس سمت میں کیا ترقی ہو چکی ہے؟ کیا اب بھی ترقی کا کوئی راستہ باقی ہے؟
ڈیکس: میرے خیال میں یہ سیکٹر تھوڑا زیادہ قیمتی لگ رہا ہے، کیونکہ بہت سارے درمیانی فریق اپنے لیے کام تلاش کرنے کے لیے پریشان ہیں۔ اگر آپ مدل لیب نہیں ہیں اور کچھ قیمتی چیز فراہم کرنا چاہتے ہیں (ہم اسی جگہ پر ہیں، ہم ریزننگ سروسز فروخت کرتے ہیں، ہم درمیانی لیئر ہیں۔) تو آپ کے پاس صرف ایک ہی چیز کرنے کا اختیار ہے کہ آپ اپنے صارفین کو بتائیں: "مدل لیب آپ کو ایک مدل کے آؤٹ پٹ کو دوسرے مدل میں استعمال کرنے کی اجازت نہیں دے سکتے، کیونکہ Anthropic آپ کو OpenAI کے مدلز کبھی فراہم نہیں کرے گا، لیکن ہم کر سکتے ہیں۔" اس لیے وہ مدل راؤٹنگ پر زور دینے لگیں گے، لیکن صداقت سے بات کریں تو، اس درمیانی لیئر پر میرے خیال میں آپ بہت زیادہ کچھ نہیں کر سکتے۔
بہترین صورت حال یہ ہے کہ جب ایک درخواست آئے، تو سسٹم فیصلہ کر سکے کہ کون سا ماڈل استعمال کرنا ہے۔ لیکن ایک بار سیشن شروع ہو جانے کے بعد، آپ ماڈل کو درمیان میں دائرہ کار میں تبدیل نہیں کر سکتے، کیونکہ اس کی لاگت بہت زیادہ ہے۔ اگر آپ سیشن کے درمیان ماڈل تبدیل کرتے ہیں، تو نیا ماڈل داخل ہونے پر پورا کیش دوبارہ شروع ہو جائے گا، جس کا خرچ بہت زیادہ ہوتا ہے۔ اس لیے مجھے لگتا ہے کہ اس سطح پر راؤٹنگ کرنا مشکل ہے۔
ہم کھلے طور پر دوسری سمت، خاص طور پر نئی نسل کے ماڈلز میں دلچسپی رکھتے ہیں، جو اورکیسٹریٹر پیٹرن پر بہت اچھا کام کرتے ہیں۔ پہلے بھی اس پیٹرن کی کوشش کی گئی تھی، لیکن میرے خیال میں پہلے کے ماڈلز کافی اچھے نہیں تھے اور عام صارفین ان کا استعمال نہیں کر سکتے تھے۔ لیکن ہماری ٹیم میں سے کسی نے نئے ماڈل کا استعمال کرتے ہوئے ایسا ڈیزائن بنایا: ایک مہنگا ماڈل مین سیشن کے لیے استعمال ہوتا ہے، لیکن اس کا پرومپٹ "کبھی بھی خود کام نہ کرنا" کے طور پر سیٹ ہوتا ہے، اور صرف سب اجینٹس بنانے کا کام کرتا ہے، جبکہ سب اجینٹس سستے ماڈلز استعمال کرتے ہیں۔ اس طرح، مین ماڈل کی ذکاوت برقرار رہتی ہے، لیکن سستے ماڈلز کو تلاش کرنے، کوڈ تبدیل کرنے جیسے مشکل اور تھکا دینے والے کاموں کے لیے استعمال کیا جاتا ہے۔ مجموعی طور پر، یہ زیادہ سستا ہوتا ہے، اور نئے ماڈلز متوازی طور پر کام کرنے میں بہت مہارت رکھتے ہیں، آپ ایک سیشن میں متعدد سب اجینٹس چلا سکتے ہیں، جو مکمل ہونے پر مین ماڈل کو جگاتے ہیں۔ آپ مکمل طور پر ایک ہی سیشن میں کام کرتے ہیں، تجربہ بہت بہتر ہوتا ہے، اور یہی حقیقی معنی رکھتا ہے۔
جو ماڈل کے بارے میں بات نہیں کی جا سکتی
ویس: آپ نے ابھی بتایا کہ آپ نے بہت سے ٹوکن جلائے ہیں اور کچھ ابھی جاری نہیں ہوئے ماڈلز استعمال کیے ہیں۔ کون سے؟ آپ نے انہیں کس چینل سے حاصل کیا؟
ڈیکس: اوپن اے آئی اور اینتھروپک دونوں کے پاس بڑے پیمانے پر پیش رفت کے منصوبے ہیں جو کچھ لوگوں کو پہلے سے رسائی دیں گے، اس لیے ہم باہر کی دنیا سے پہلے کچھ چیزوں کو دیکھ سکتے ہیں۔ میں خاص طور پر کس لیب کا نام نہیں لے رہا، لیکن نئے ترین ماڈل نے ہمارے ٹوکن استعمال کو فوراً پانچ گنا کر دیا۔
ویس: یہ اس لیے نہیں کہ یہ خود کو زیادہ ٹوکن استعمال کرتا ہے، بلکہ اس لیے ہے کہ یہ آپ کے کام کرنے کے طریقے کو تبدیل کر دیتا ہے، صحیح؟
ڈیکس: جو لوگ ہمارے بارے میں جانتے ہیں، وہ جانتے ہیں کہ ہم ایک بہت محتاط ٹیم ہیں۔ سالوں تک ہم AI کوڈنگ کے ساتھ بہت ساہسی رہے ہیں، اور ہم وہ AI جنونی نہیں ہیں جو اس کے استعمال اور صلاحیتوں کے بارے میں بہت زیادہ دعوے کرتے ہیں۔ لیکن میں کہنا چاہوں گا کہ ہماری ٹیم نئی نسل کے ماڈلز پر مکمل طور پر مبتلا ہو گئی ہے۔ جب پریویو فیس کا دور ختم ہوا اور ہمیں اس تک رسائی ختم ہو گئی، تو تمام افراد اس چیز کے ضائع ہونے کے لیے رونے لگے۔ کسی نے پوچھا، "تو اب کام کا کیا مطلب؟" اور ان دنوں AI کے لیے بہت ساری جنازہ تصاویر بنائی گئیں، وہ دن واقعی بہت مشکل تھے۔
میں یہ نہیں کہ رہا کہ نئے ماڈل اتنے “سمرتھ” ہو گئے ہیں یا وہ اچانک انسانوں کی جگہ لے سکتے ہیں۔ اصل بات یہ ہے کہ انہوں نے استعمال کے لیے کچھ باریکیوں کی ہیں، ایک مثالی توازن تلاش کیا ہے، اور اب آپ ان پر حقیقی طور پر بھروسہ کر سکتے ہیں۔ وہ آپ کی باتوں کو سنجیدگی سے سنیں گے اور آپ کی نظر انداز کردہ چیزوں کو پکڑ لیں گے۔ یہ اچانک انسان نہیں بن گیا، بلکہ ایک بہتر شریک بن گیا، جس کا ہمارے ڈیٹا سے ثبوت ملتا ہے۔
اسکاٹ: تو ہیڈ نہیں والی بڑی کمپنیوں کے ماڈل کیسے ہیں؟ جیسے آپ استعمال کر رہے ہیں OpenCode Go جیسے؟ کیا ان میں ترقی ہوئی ہے؟
ڈیکس: ہاں۔ پیش نظارہ ماڈل تک رسائی کھوئے کے، ہمارے آدھے لوگ GPT 5.5 پر واپس آ گئے ہیں، اور دوسرے آدھے GLM 5.2 استعمال کر رہے ہیں۔ میں خود بھی GLM 5.2 استعمال کر رہا ہوں، اور مجھے لگتا ہے کہ یہ GPT 5.5 کے بہت قریب ہے۔ نئے ماڈلز کو استعمال کرنے کے بعد، پرانے ماڈلز ایک جیسے لگتے ہیں، اس لیے میں اب جو بھی استعمال کر رہا ہوں، وہ کوئی بھی چل جاتا ہے۔ لیکن GLM 5.2 کا GPT 5.5 کی جگہ لینا اس بات کا ثبوت ہے کہ وہ ترقی کر رہے ہیں اور ان کے درمیان فرق ہر دن کم ہو رہا ہے۔
میرا ذاتی خیال یہ ہے کہ ابتدائی ماڈلز ہمیشہ کچھ فائدہ برقرار رکھیں گے، کیونکہ پہلے آنے والوں کے پاس کچھ مرکب اثرات ہوتے ہیں۔ لیکن سچ بولوں تو، ہم نے Go پر بہت زیادہ استعمال دیکھا ہے، جہاں کچھ لوگ اسے سب کاموں کے لیے استعمال کر رہے ہیں۔ شاید ہم ایک اعلی تنخواہوں کے ببل میں ہیں، جہاں مالی قیمتیں اعلیٰ ہیں اور ابتدائی ماڈلز استعمال کرنے کا خرچ برداشت کیا جا سکتا ہے۔ لیکن دنیا کے زیادہ تر لوگوں کے لیے صورتحال الگ ہے۔ امریکہ میں بھی، جب ہم نے Go کا سستا پلان، جو کہ اوپن سورس ماڈلز کے لیے تھا، جاری کیا، تو ہم سمجھتے تھے کہ یہ عالمی صارفین کے لیے ایک بین الاقوامی پلان ہوگا، لیکن امریکہ ہمارا سب سے بڑا سبسکرائب کرنے والا ملک رہا۔ ڈویلپرز اور کوڈ لکھنا چاہنے والوں کا گروپ بہت بڑا ہے، اور ان میں سے بہت سارے لوگوں کے لیے مہینے کا 200 امریکی ڈالر کا پلان بھی ناممکن ہے۔
ویس: میں جاننا چاہتا ہوں کہ آپ کو قیمتیں مستقبل میں کیسے بڑھیں گی، کیا ہم دیکھیں گے کہ کمپنیاں ہر ملازم کے لیے ماہانہ 1000 ڈالر، 2000 ڈالر خرچ کر رہی ہیں؟ یا نئے چپس جیسی چیزوں کے ظہور کے ساتھ قیمتیں مستحکم ہو جائیں گی؟
ڈیکس: ہمارے پاس پچھلے ایک ماہ کا ڈیٹا ہے، جب کمپنی کے استعمال میں اچانک اضافہ ہوا، تو ہم نے اس کی لاگت کا حساب لگایا اور اسے مزدوری کے بجٹ سے موازنہ کیا۔ ہمارے لیے، یہ استعمال بہت زیادہ ہے، تقریباً تنخواہوں کا 15 فیصد۔ یعنی، آپ جتنا اپنی ٹیم کو تنخواہ دیتے ہیں، انہیں ان ماڈلز تک رسائی حاصل کرنے کے لیے اس کا اضافی 15 فیصد "ٹیکس" ادا کرنا پڑتا ہے۔ سچ بولوں تو، یہ بہت خراب نہیں ہے۔ جیسے ہم جیسی ٹیک کمپنیوں میں عام طور پر فرد کی آمدنی بہت زیادہ ہوتی ہے، اور 15 فیصد مجموعی سندھ میں حقیقت میں ناچیز ہے۔ لیکن ہر صنعت اس طرح نہیں ہے۔
تاہم، یہ قیمتیں کم ہو جائیں گیں، اور بہت زیادہ کم۔ اگر آپ قیمت کے لحاظ سے حساس ہیں، تو اوپن سورس ماڈلز بہت سستے ہیں۔ مجھے لگتا ہے کہ یہ بات بہت الجھن والی ہے، کیونکہ بہت سے سرخیاں یہ کہتی ہیں کہ OpenAI اور Anthropic نقصان میں ہیں اور کبھی کامیاب نہیں ہو سکتے، لیکن حقیقت میں ریزننگ کا منافع بہت زیادہ ہے، خاص طور پر جبکہ OpenAI اور Anthropic اب بھی اپنی قیمتیں بڑھا رہے ہیں۔ میرا اندازہ ہے کہ ان کا ریزننگ منافع تقریباً 90% ہے، جس کا مطلب ہے کہ براک even point کم از کم 10 گنا سستا ہو سکتا ہے۔
ویس: پہلے کسی نے مجھے بتایا تھا کہ استدلال کا مارجن 70% ہے، تو 70% سے 90% تک۔ یہ صرف ماڈل کی تربیت کی لاگت نہیں ہے، ہے نا؟
ڈیکس: بالکل، تحقیق و ترقی کی لاگت بھی۔ لیکن ایک کاروبار کے طور پر، آپ ان دو چیزوں کو الگ الگ دیکھیں گے، کیونکہ آپ تحقیق و ترقی بند کر سکتے ہیں اور پھر بھی کمائی کر سکتے ہیں۔
ویس: اور وہ لوگ جو سوچتے ہیں کہ وہ اپنے ہی گھر پر ماڈل چلا سکتے ہیں، آپ ان لوگوں کے بارے میں کیا سوچتے ہیں جو اپنے پیچھے مشین چلانے کا خیال رکھتے ہیں؟
ڈیکس: میں اس موضوع پر بات کرتے وقت بہت احتیاط کرتا ہوں، کیونکہ اس کمیونٹی کے لوگ آسانی سے غصہ کر لیتے ہیں۔ تو میں پہلے یہ بات واضح کر دیتا ہوں: لوگوں کے اپنے گھر پر ماڈل چلانے کے بہت سارے مناسب وجوہات ہیں۔ اگر آپ صرف اس لیے نہیں چاہتے کہ آپ کا ڈیٹا آپ کے گھر سے باہر جائے، تو یہ بالکل سمجھ میں آتا ہے۔ لیکن اگر آپ لاگت پر توجہ دے رہے ہیں، تو لوکل ماڈل آپ کو پیسے بچانے میں مدد نہیں کریں گے، کیونکہ کوئی بھی مکانی ہوسٹنگ کو سستا بنانے والا مکانی نظام، کلاؤڈ ہوسٹنگ کو 10 گنا سستا بنائے گا۔ اگر ایک ماڈل زیادہ موثر ہو جائے، یا چھوٹا سائز ہونے کے باوجود زیادہ طاقتور صلاحیت حاصل کر لے، تو صرف کلاؤڈ پر ہر ٹوکن کی لاگت کم ہو جائے گی۔ اس لیے میرا خیال ہے کہ لوکل ماڈل زیادہ تر خفیہ رکھنے کا مسئلہ ہیں، لاگت کا نہیں۔
ہم GPU کو ایجنٹس کے ذریعے ہوسٹ کرتے ہیں، لیکن اس کے باوجود، کچھ ماڈلز کو ہم اپنی قیمت سے 70% سستے اخراجات پر ہوسٹ کر سکتے ہیں، جو بہت سستا ہے۔ اس کا مطلب ہے کہ اگر ہم قیمت پر فروخت کریں تو، ایجنٹس کے استعمال کے باوجود، ہمیں 70% منافع ہوگا۔ اگر آپ براہ راست GPU خریدیں، تو شاید اینتھروپک کی تخمینہ لگائی گئی 90% منافع کی شرح حاصل کر سکیں، جس کا مطلب ہے کہ لاگت بہت بہت کم ہو سکتی ہے۔ بالکل، یہ باتیں صرف اوپن سورس ماڈلز کے بارے میں ہیں۔ ہمیں اس بات پر انحصار کرنا ہوگا کہ اوپن سورس ماڈلز لگاتار بہتر ہوتے رہیں، لیکن موجودہ رجحان بالکل اسی سمت میں چل رہا ہے۔
اوپن کوڈ کو کلاؤڈ کوڈ نے بند کر دیا؟
اسکاٹ: تو چلیے کلید کوڈ کے بارے میں بات کرتے ہیں۔ ان کی پوزیشن ہمیشہ بہت واضح نہیں رہی، کیا OpenCode جیسے فراہم کنندگان کلید کوڈ میکس پلان کا استعمال کر سکتے ہیں؟ اب تک بالآخر کیا حالت ہے؟
ڈیکس: اس اندراج کے بارے میں، اوپن کوڈ میں وہ پلگ ان جو آپ کو میکس پیکیج استعمال کرنے کے لیے مجبور کرتا ہے، یہ بالکل ممنوع ہے۔ ہم نے اس پر ان سے لمبا بحث کیا، لیکن آخرکار ہم نہیں جیت سکے۔ بالکل یہی بات ہے کہ لوگ ہمیشہ حدود کو ہیک کرکے دور کرنے کا طریقہ تلاش کر لیتے ہیں، لیکن ہم اس طرح کے عمل کو سرکاری طور پر سپورٹ نہیں کر سکتے۔
SDK کے بارے میں، جس طرح کے بغیر ہیڈ مود میں کلوڈ کو کال کیا جاتا ہے، وہ اب ایک رنگین علاقے میں ہے، اور وہ ابھی تک کہتے ہیں کہ یہ مجاز ہے۔ اس لیے کنڈکٹر جیسے پروڈکٹس اسے پیکج کر سکتے ہیں، اور T3 کوڈ بھی اسے پیکج کر سکتا ہے۔ لیکن ہم کبھی بھی اسے پیکج نہیں کریں گے، کیونکہ یہ اوپن کوڈ کے اصل مقصد کے خلاف ہے۔ اس لیے وہ اورکیسٹنگ ٹولز یا متبادل UI، مجھے لگتا ہے کہ ان پروڈکٹس کا ابھی تک استعمال ممکن ہے، لیکن دوبارہ، صورتحال اب بھی واضح نہیں ہے۔
یہ بالآخر کمپنی کی ثقافت کا مسئلہ ہے، کیا آپ ایک صرف صارفین کے لیے موزوں کمپنی ہیں یا ایک صرف کاروباری کمپنی۔ OpenAI ایک بہت زیادہ صارفین کے لیے موزوں کمپنی ہے، جس کا مطلب ہے کہ وہ جتنی بھی رقم خرچ کریں، جتنی بھی رقم جمع کریں، تاکہ تجربہ زیادہ لوگوں تک پہنچایا جا سکے، اسی لیے OpenAI کا سبسکرپشن OpenCode میں سرکاری طور پر سپورٹ کیا جاتا ہے، جبکہ میرے خیال میں Anthropic کی بالکل ایسی ہی ثقافت نہیں ہے۔
اگر آپ ایک کاروباری کمپنی ہیں، تو صورتحال بالکل مختلف ہوتی ہے، اور آپ جتنی بھی استدلالی کوششیں صارفین کے استعمال کے لیے مختص کرتے ہیں، ایک فروخت کار متعلقہ ہو جاتا ہے: "میرے پاس ایک کاروباری صارف ہے جو اصل قیمت پر ادائیگی کرنے کو تیار ہے۔" اگر آپ کے پاس حسابی طاقت محدود ہے، تو OpenCode صارفین کو استعمال کرنے کا اندر کے طور پر تسلیم کرنا مشکل ہوتا ہے۔ حالانکہ اب ان کی حسابی طاقت پہلے سے زیادہ ہونی چاہیے۔
اسکاٹ: کیا یہی وہ وجہ ہے جس کی وجہ سے وہ چاہتے ہیں کہ آپ اس کا استعمال نہ کریں؟ بہت سے لوگ کہ رہے ہیں: "اس کا کیا فرق پڑتا ہے؟ میں نے سبسکرپشن فیس ادا کی ہے، تو میں اسے کہیں بھی کیوں نہیں استعمال کر سکتا؟" اور کچھ لوگوں کا خیال ہے کہ وہ ڈیٹا ٹریننگ اور کنٹرول کے لیے چاہتے ہیں۔ لیکن حقیقت بہت سادہ ہے، وہ صرف کمپوٹیشنل پاور سے محدود ہیں؟
ڈیکس: دراصل، ہر کمپنی بنیادی طور پر ایک فنل ہوتی ہے، جہاں آپ اوپری سر پر چیزیں رکھتے ہیں تاکہ صارفین کو متوجہ کیا جا سکے، اور مثالی صورت میں وہ نیچے تک ٹرانس فارم ہو جائیں۔
انہوں نے کلود کوڈ کو فنل کے اوپری حصے کے طور پر ڈیزائن کیا ہے، جو ایک بہت زیادہ صارف کی طرف مائل مصنوع ہے۔ آپ اس کا استعمال کرتے ہیں، پھر آپ کی کمپنی استعمال شروع کرتی ہے، اور پھر آپ کی کمپنی ٹوکن کے لحاظ سے ادائیگی شروع کرتی ہے۔ لیکن اگر صارفین OpenCode کے ذریعے استعمال کریں، تو یہ تبدیلی کا سلسلہ توڑ سکتا ہے، کیونکہ OpenCode میں آپ دوسرے ماڈلز میں آزادانہ طور پر تبدیلی کر سکتے ہیں۔ اگر آپ کو کلود پسند نہیں آتا، تو آپ کسی بھی وقت نئے مقبول ماڈل پر منتقل ہو سکتے ہیں۔
دوسرا سبب کیفیٹی کی مقابلہ کن مانگ ہے، جو بھی آپ ڈھانچے کے اوپری سر پر لگاتے ہیں، اسے ثابت کرنا ہوگا کہ یہ آخرکار ڈھانچے کے نچلے سر پر واپس آئے گا۔ اگر آپ صارفین کے لیے کمپنی ہیں، تو اس حوالے سے آپ زیادہ لچکدار ہو سکتے ہیں۔
ویس: کیا آپ نے کبھی سوچا ہے کہ مستقبل میں ایک ایسا ماڈل ظاہر ہوگا جس کا کوئی API نہیں ہوگا، اور آپ صرف ان کی ایپ کے ذریعے ہی استعمال کر سکیں گے؟ جیسے ElevenLabs، جس کی ایک بہت اچھی ایپ ہے، لیکن آپ کو ماہانہ سبسکرپشن لینا ہوگا، آن ڈیمانڈ پر ادائیگی نہیں کر سکتے۔ کیا آپ کو لگتا ہے کہ یہ صورتحال آئے گی؟
ڈیکس: ہاں، یہ دوبارہ کمپنی کی اندر کی ساخت کو ظاہر کرتا ہے۔ پروڈکٹ ٹیم اس طرح کے عمل کو بہت زیادہ سپورٹ کرے گی، وہ کہہ سکتی ہے: “ہم ایک بہت ہی مخصوص ماڈل بناسکتے ہیں، اس کے اردگرد ایک مخصوص پروڈکٹ تیار کر سکتے ہیں، دونوں کو ایک ساتھ جوڑ سکتے ہیں، اگر آپ ماڈل استعمال کرنا چاہتے ہیں تو آپ کو ہمارا پروڈکٹ استعمال کرنا ہوگا۔” یہ پروڈکٹ فوکسڈ ٹیم کے لیے ایک بہت بہترین لॉک ان اسٹریٹجی ہے۔
لیکن فروخت کی تنظیم کے پاس آمدنی کے اہداف ہوتے ہیں، وہ کہتے ہیں: "ہمارا آمدنی کا ہدف 100 ارب ہے۔ آپ کا API یا مصنوعات کا منفرد ماڈل صرف 50 ارب تک ہی پہنچ سکتا ہے، باقی 50 ارب کا فرق کون بھرے گا؟" فروخت کی ٹیم زور دے کر کہتی ہے: "نہیں، ماڈل کو API میں شامل کرنا ضروری ہے، تاکہ ہم اپنے اہداف کو بہتر طریقے سے حاصل کر سکیں۔" جب تک یہ اندر کا تنازع قائم رہے گا، تنظیم کے لیے آمدنی کا کچھ حصہ ضائع کرکے مارکیٹ شیئر حاصل کرنے کا منطق ثابت کرنا مشکل ہوگا۔
جب یہ لیبارٹریز مزید زیادہ پروڈکٹ لیول پر آنے لگیں، تو وہ ایک "نامناسب بٹن" کے برابر ہو جائیں گی، اور میں اس بات سے حیران نہیں ہوں گا کہ وہ کبی نہ کبی اسے دبائیں گے۔ اور وہ اسے عجیب طریقے سے منطق دیں گے، جیسے "یہ ماڈل بہت خطرناک ہے، صرف ہمارے فریم ورک کے اندر استعمال کرنا ہی محفوظ ہے، ہم اسے دوسرے فریم ورکس میں استعمال نہیں ہونے دیں گے۔" یہ اصل وجہ نہیں ہے، لیکن یہی ان کا دعویٰ ہوگا۔
ویس: فیبل کے بارے میں سیکورٹی کے مسائل، کیا یہ سب نئے مڈلز بے ایمن ہیں؟ حکومت کہتی ہے کہ وہ بے ایمن ہیں، کیا یہ سچ ہے یا صرف ہائپ؟
ڈیکس: میں سمجھتا ہوں کہ بہت سی چیزیں سچ ہیں، اور وہ باہمی طور پر تناقض رکھ سکتی ہیں، اور یہ ماڈل واقعی بہت بڑے نقصان کا امکان رکھتے ہیں۔ حکومت کا کہنا ہے کہ ہمیں جاری کرنے سے پہلے کسی قسم کی جانچ کرنا چاہیے، یہ منطقی ہے۔ اگر آپ ایک بڑی کمپنی جیسے میٹا میں ہیں، تو جب وہ کوئی پروڈکٹ جاری کرتے ہیں، جیسے اپ لوڈ کرنے والے پروفائل تصویر کا فنکشن، تو انہیں حکومت کو ثابت کرنا ہوگا کہ وہ اس فنکشن کے لیے بچوں کی جنسی استعمال کی فلٹرنگ کر رہے ہیں۔ اس سطح پر، سب سے چھوٹے اندرونی فنکشن بھی ناممکن حد تک تنظیم کا شکار ہوتے ہیں۔
لیکن مسئلہ یہ ہے کہ اگر یہ عمل بہت بے وقوف یا فسادی ہو، تو نتیجہ مدل کی مکمل منظوری اور سب کے لیے وسیع رسائی کے بجائے حکومتی عمل کے ذریعے عدم مساوات والی رسائی کا ہوگا، جو بہت بری بات ہوگی، اور میں امید کرتا ہوں کہ یہ نہ ہو۔ میں زیادہ بھلی بھاتی نتیجہ دیکھنا چاہوں گا کہ جب وہ ہر نئے مدل جاری کرتے ہیں، تو صرف ایک ماہ کا وقت لینے والا عمل پورا کرنا پڑتا ہے۔
دوسری طرف، یہ ایک مکمل طور پر منطقی مسئلہ نہیں ہے۔ میرے خیال میں ان لیبز کو یہ دعویٰ کرنے کا کوئی مطلب نہیں کہ وہ "پرماں بم" رکھتے ہیں، کیونکہ اس سے سیاسی دلچسپی پیدا ہو سکتی ہے۔ یہ ایسے ہے جیسے آپ ایک بم کے ساتھ کھیل رہے ہوں جو ناکارہ صورتحال کی طرف جا سکتا ہے یا پھر بہت خراب صورتحال بن سکتا ہے، جیسے غلط تنظیم، زیادہ جوشیلے اقدامات، جو پوری معیشت کے لیے نقصان دہ ہوں۔ اس لیے میں چاہتا ہوں کہ ان لیبز کو عوامی سمجھ میں زیادہ احتیاط کرنا چاہیے، کیونکہ آپ نہیں کہہ سکتے کہ میرے پاس پرماں بم ہے اور اس کے بعد کچھ بھی نہ ہونے کی توقع رکھیں۔
ای آئی انٹرایکشن ہاتھوں کے بغیر کی طرف بڑھ رہا ہے
اسکوٹ: MCP، سکل، اور AI پروگرامنگ کے لیے استعمال ہونے والے ٹولز کے بارے میں بات کرتے ہیں۔ کیا واقعی قابل توجہ اور استعمال کے لائق ہے؟ آپ سب کون سا استعمال کر رہے ہیں؟
ڈیکس: ہماری زیادہ تر شخصی ترتیبات بہت بنیادی ہیں۔ اصل میں دلچسپ بات ہماری ٹیم کے اندر کا ڈسکورڈ روبوٹ ہے، جس میں ہماری ذاتی ترتیبات کے مقابلے میں زیادہ MCP اور مہارتیں ہیں۔ ہمارے پاس "Gang Growth" نام کا ایک چیز ہے، جو کِٹ لینگ نے سوچا تھا۔ جب بھی ہم کسی مسئلے میں پھنس جاتے ہیں، چاہے وہ کاروبار، API ڈیزائن ہو یا عمل میں، ہم ڈسکورڈ روبوٹ میں آواز کے ذریعے پرومپٹ درج کرتے ہیں اور @OpenCode کو ٹیگ کرتے ہیں، جو ایک تعاونی ٹول کی طرح کام کرتا ہے۔
یہ روبوٹ کمپنی کے تمام ڈیٹا لیکس سے جڑا ہوا ہے، میں اس سے پوچھ سکتا ہوں، "گزشتہ ہفتے، تمام اضافی چارج کے ساتھ Go سبسکرپشن استعمال کرنے والے صارفین نے کل کتنی رقم خرچ کی؟" اور یہ اس کا حساب لگا دے گا۔ ہماری ٹیم کی عادت میں تبدیلی یہ ہوئی ہے: لگتا ہے کہ کسی اور کو @ کرنے کی کوئی وجہ نہیں رہ گئی۔ اگر آپ کو کوئی سوال ہے، تو پہلے @OpenCode کریں۔ اگر دوسرے لوگ دیکھتے ہیں، تو وہ بھی شامل ہو جاتے ہیں۔ لیکن OpenCode اکثر خود ہی کام پورا کر لیتا ہے۔
اسکاٹ: اگر روبوٹ کو آپ کو معلومات واپس کرنی ہوں تو؟ اب سب مکھ طور پر ایم سی پی یو آئی یا ہیمل فائل کو براہ راست جنریٹ کرنے پر بات کر رہے ہیں، آپ کو کیا لگتا ہے کہ مستقبل میں کوڈنگ ایجینٹ معلومات کو کس طرح دکھائے گا؟
ڈیکس: ہم ضرور OpenCode میں کوئی ایسی آرٹی فیکٹس فیچر شامل کریں گے جو اسے آپ کو دستاویزات بنانے اور بھیجنے کی اجازت دے۔ یہ HTML اور SVG کا استعمال کرتے ہوئے ویژولائزیشن کرتا ہے، بہت دلچسپ ہے۔ اس کے لیے کوئی خاص چیز درکار نہیں، صرف ایجنٹ کی صلاحیتوں کا استعمال ہے۔ جبکہ MCP UI کے بارے میں، میں نے ابھی تک اس کا گہرا جائزہ نہیں لیا، میں سمجھتا ہوں کہ ہم ڈیسک ٹاپ ایپ میں اس کا سپورٹ فراہم کریں گے، خاص طور پر جب ہم غیر تکنیکی صارفین پر توجہ دینا شروع کریں گے، کیونکہ میرا خیال ہے کہ ان کے سوالات اور ان کے کرنے کی ضرورت والی چیزیں کچھ ڈائنانمک UI یا زیادہ غنائی چیزوں سے فائدہ اٹھائیں گی۔
ہماری ٹیم اب صوتی پرامپٹنگ (Voice Prompting) میں مبتلا ہو چکی ہے، اور ہم Discord پر ایک دوسرے کو میسج بھیجتے وقت بھی صوتی استعمال کرتے ہیں، کیونکہ ہم ٹائپ کرنا پسند نہیں کرتے۔ جب آپ اس سے براہ راست بات کر سکتے ہیں، تو بہت سے UI، خاص طور پر انٹرایکٹو UI، میں صرف اس بات کا تصور کرنا پسند کرتا ہوں کہ میں کیا چاہتا ہوں۔ اگر مجھے سب کچھ ٹائپ کرنا پڑے تو یقیناً بہت بری بات ہے۔ لیکن میں صوتی استعمال کر سکتا ہوں، اور صوتی اب بہت تیز ہے اور لوکل رن ہوتی ہے۔
اسکاٹ: میں نے ایک پیڈ خریدا کیونکہ بہت سارے آواز کے حکم تھے۔ ایک پیڈ "اینٹر" کے لیے تھا، دوسرا "ڈکٹیشن ٹریگر" کے لیے تھا، اور ایک ٹیب بدلنے کے لیے۔ میں صرف اس کے ساتھ بیٹھا رہا اور یہ بہت اچھا لگا۔

ڈیکس: بہت سے لوگ اس کے بارے میں شک کرتے ہیں، اور میں مکمل طور پر سمجھتا ہوں، کیونکہ میں نے بھی کٹ کو یہ کرتے دیکھ کر ہی شروع کیا۔ جب آپ دیکھتے ہیں کہ کوئی اور یہ کر رہا ہے، تو آپ کے دماغ میں کچھ چیز کھل جاتی ہے۔ اگر آپ نے کبھی ایسا نہیں کیا، تو آپ کو یہ الجھن والی بات لگے گی۔ لیکن یہ اصل میں سب سے قدرتی چیز ہے، آپ بے ترتیب باتیں کر سکتے ہیں، گڑبڑا سکتے ہیں، گلوں میں لپٹ سکتے ہیں، اس سے کوئی فرق نہیں پڑتا، کیونکہ LLM آپ کا واقعی مطلب سمجھنے میں ماہر ہے۔
ویس: کیا آپ کِٹ کے ہیکس ایپ کا استعمال کر رہے ہیں؟
ڈیکس: میں مین ڈیوائس پر ہینڈی استعمال کرتا ہوں، اور میک پر ہیکس۔ ماڈل اچھا ہے، اور یہی اہم ہے۔
ویس: میرا ٹریگر طریقہ بہت آسان ہے، مائیس پر ایک چھوٹا بٹن ہے، جسے دو بار کلک کریں۔ کچھ لوگ ایک ایسا انگوٹھی بنا رہے ہیں جسے آپ ٹھونک سکتے ہیں، وہ مجھے ایک بھیجیں گے، میں اسے آزماؤں گا۔

ڈیکس: میں اب بھی زیادہ تر وقت اپنی انگلیاں کیبورڈ پر رکھتا ہوں، اس لیے میں نے ایک شارٹ کٹ سیٹ کیا ہے۔
ویس: کیا کچھ ایسا ہے جو ہم نے اب تک نہیں باتا لیکن آپ خاص طور پر کہنا چاہتے ہیں؟ جیسے آپ کی ذاتی رائے؟
ڈیکس: میں آنے والے نئے جنریشن کے ماڈل سے بہت متوجہ ہوں۔ عام طور پر جب کوئی نیا ماڈل جاری ہوتا ہے، تو سب کچھ ایک جیسا لگتا ہے، اور میں اکثر اس بات پر پوسٹ بھی کرتا ہوں۔ لیکن اس بار پہلی بار محسوس ہوا کہ یہ ماڈل حقیقت میں بہت سے لوگوں کے استعمال میں آ سکتے ہیں۔ یہ ٹیکنیکل طور پر جاری ہو چکے ہیں، صرف حکومت عام صارفین کو استعمال نہیں کرنے دے رہی۔
ویس: اب مختلف بینچ مارکس اور اسکورز موجود ہیں، اور لوگ کہ رہے ہیں کہ "بہت بہتر محسوس ہو رہا ہے"، کیا آپ کو لگتا ہے کہ ہم کبھی ایک حقیقی معنی خیز بینچ مارک حاصل کر پائیں گے؟
ڈیکس: سچ بولوں تو، میں اب بیچنگ ٹیسٹس پر بالکل نظر نہیں ڈالتا، میں یہاں تک کہ نہیں جانتا کہ کیا میں نے کبھی انہیں حقیقت میں دیکھا ہے، مجھے لگتا ہے کہ یہ اسکورز پہلے ہی پس منظر کی آواز بن چکے ہیں۔ ہم سب جانتے ہیں کہ اعداد و شمار بڑھ رہے ہیں، اور یہ مقابلہ کرنے والوں سے زیادہ بڑھ رہے ہیں، لیکن جب مقابلہ کرنے والے اپنا اعلان کرتے ہیں، تو ان کے اسکورز زیادہ بڑھ جاتے ہیں، اس کا کیا مطلب ہے؟
تو اب میں صرف معیاری فیڈبیک دیکھ رہا ہوں۔ مجھے لوگوں کو یہ بتاتے ہوئے دیکھنا پسند ہے کہ وہ ماڈل کا استعمال کر کے کیا کر سکتے ہیں، کیا بنائے ہیں۔ آپ لاکھوں ڈیٹا پوائنٹس کے سطح پر اس قسم کا فیڈبیک حاصل نہیں کر سکتے، لیکن ان پروڈکٹس کا بنیادی طور پر ادھورا ہونا ہے، اور آخر کار یہ سوال ہے کہ صارف خوش ہے یا ناراض؟ اسی لیے میں اپنی ٹیم کے ٹوکن استعمال کو دیکھنا پسند کرتا ہوں۔ اگر منحنی اوپر کی طرف جا رہا ہے، تو اس کا مطلب ہے کہ کچھ کام کر رہا ہے، اور لوگ کسی چیز سے لطف اندوز ہو رہے ہیں۔ ہماری ٹیم میں Claude کے فین، GPT کے فین، اور اوپن سورس ماڈل کے فین سب موجود ہیں، اس لیے ہم تمام رخوں پر اچھا کوریج رکھتے ہیں۔
اسکاٹ: کیا آپ کے پاس کوئی خاص چیز ہے جسے آپ شیئر کرنا چاہیں گے؟
ڈیکس: بے شک، وہی exe.dev ہے جس کا میں نے پہلے ذکر کیا تھا۔ اگر آپ "کلاؤڈ میشین" کے خیال کا تجربہ کرنا چاہتے ہیں، تو یہ ایک بہت ہی ذکی پروڈکٹ ہے جو بہت اچھی طرح سے تیار کیا گیا ہے۔ اس کا میرے لیے Tailscale جیسا محسوس ہوتا ہے، وہی چیز جو "یہ حقیقت میں کام کر رہی ہے" کا احساس دلاتی ہے، اور exe.dev کا بھی اسی طرح کا جذبہ ہے۔ میں خاص طور پر ان پروڈکٹس کو پسند کرتا ہوں جو اپنا مقام بالکل صحیح طریقے سے تلاش کر لیتے ہیں، اور یہ پروڈکٹ بالکل ایک عجیب خالی جگہ میں فٹ ہو جاتا ہے۔ آپ AWS یا دوسری جگہوں سے سرور کرایہ پر لے سکتے ہیں، لیکن آپ کو تیز، مستقل ڈسک والے اور معقول قیمت والے سرور کرایہ پر لینا مشکل ہوتا ہے۔ یہ گڑھا پہلے صرف ان شدید VPS فراہم کنندگان نے بھر رکھا تھا جو ظاہر ہوتے اور غائب ہو جاتے تھے۔
کچھ سال پہلے جب میں نے اپنا پہلا ڈیولپمنٹ سرور سیٹ اپ کیا، تو میں نے سب سے سستا حل تلاش کیا، جس سے میں نے میامی میں ایک VPS فراہم کنندہ کو چنا۔ وہ لڑکا اپنی موت کا جھوٹ بنا رہا تھا، اور اس کا سرور بند ہو گیا۔ اس نے سب کو ای میل بھیجی کہ “میں ایک طبی سرجری کے لیے جا رہا ہوں، تین دن کے لیے انٹرنیٹ سے الگ ہو جاؤں گا،” لیکن تین دن کے بعد سرور واقعی بند ہو گیا۔ میں نے سوچا “اوہ ہو، کچھ تو ہو گیا؟” ایک ماہ گزر گیا، لیکن کسی نے اس سے رابطہ نہیں کیا۔ آخرکار میں نے فورم پر ایک پوسٹ تلاش کی، جس میں کسی نے پتہ لگایا کہ وہ پہلے بھی ایک VPS سروس چلا رہا تھا، جو اسی طرح غائب ہو گئی تھی۔ وہ سستے، بلند پرفارمنس والے سرورز کا مارکیٹ بالکل بے قاعدہ تھا۔ میرے لیے اب تک ایک راز ہے کہ یہ کون سا جعلی منصوبہ تھا؟ میں نے اسے ادائیگی کر دی تھی، تو وہ میرے لیے خدمات فراہم کرنے کے بجائے غائب کیوں ہو گیا؟
ویس: آپ آپ کے دیکھنے والوں کو کیا تجویز کرنا چاہیں گے؟
ڈیکس: اگر آپ اپنا خود کا کچھ بنانا چاہتے ہیں، تو میں OpenTUI کی تجویز کرتا ہوں۔ اگر آپ TUI تعمیر کر رہے ہیں، تو یہ ایک بہترین طریقہ ہے۔ آپ React، SolidJS یا حتیٰ کہ Vue بائندنگس کا استعمال کرکے اعلیٰ پرفارمنس والے TUI تعمیر کر سکتے ہیں۔ OpenCode اسی کا استعمال کرکے تعمیر کیا گیا ہے، اور ہم 1.0 ورژن کی طرف بڑھ رہے ہیں۔ حالیہ وقت میں ٹرمینل پروڈکٹس اور ایپلیکیشنز میں ایک نئی ترقی کا رجحان دیکھا جا رہا ہے۔
اسکاٹ: اس کا استعمال کون کر رہا ہے؟ کیا نیا Grok بنانے یا xAI کی چیز بھی ہے؟
ڈیکس: گروک کا CLI بہت اچھا کام کرتا ہے، اس کی ادائیگی بہت خوبصورت اور کارکردگی بہتر ہے، لیکن وہ رسٹ میں لکھا گیا ہے، اور وہ شاید رٹیٹوائل کا استعمال کر رہے ہیں۔ تاہم نیا ہرمس پروکسی TUI OpenTUI کے ساتھ بنایا گیا ہے۔ کمیونٹی تیزی سے بڑھ رہی ہے، اب جب بھی میں اپنے ٹائم لائن پر TUI دیکھتا ہوں، تو زیادہ تر امکان ہے کہ یہ OpenTUI ہے، خاص طور پر کیونکہ آپ اسے vibe coding کے طریقے سے لکھ سکتے ہیں، کیونکہ یہ بنیادی طور پر ری ایکٹ ہے۔
