اوپن اے آئی نے GPT-5.6 Luna اور Terra API کی قیمتیں کم کر دیں، تیز تر Sol موڈ متعارف کرایا

icon MarsBit
بانٹیں
AI summary iconخلاصہ
اوپن اے آئی نے GPT-5.6 Luna اور Terra API کی لاگتیں کم کر دیں، جس میں Luna کی ان پٹ اور آؤٹ پٹ فیسز دونوں 80% کم ہو گئیں اور Terra کی 20% کم ہو گئی۔ Sol ماڈل اب ایک جیسی قیمت پر 2.5 گنا تیز Fast mode فراہم کرتا ہے۔ Sol سے حاصل ہونے والی کارکردگی میں اضافہ، جس میں سپیکولیٹو ڈیکوڈنگ اور GPU Kernel میں بہتری شامل ہے، لاگت کم کرنے میں مدد کرتا ہے۔ جبکہ خوف اور لالچ انڈیکس کے رجحانات سے مارکیٹ کے اعتماد میں اضافہ دکھائی دے رہا ہے، ان کمیوں سے AI ایجینٹس کے استعمال میں اضافہ ہو سکتا ہے اور ہائی فریکوئنسی ٹریڈنگ میں کرپٹو قیمت کے ڈائنانامکس پر اثر پڑ سکتا ہے۔

ایجنٹ

لُنا کا ابتدائی مدل، ہر ملین ٹوکن کی درجہ بندی کی قیمت 1 ڈالر سے گھٹ کر 0.2 ڈالر ہو گئی ہے، اور اخراج کی قیمت 6 ڈالر سے گھٹ کر 1.2 ڈالر ہو گئی ہے۔

چینی یوان میں تبدیلی، درج کردہ قیمت 6.8 یوان سے گھٹ کر 1.35 یوان ہو گئی، جبکہ نکاسی قیمت 40.6 یوان سے گھٹ کر 8.1 یوان ہو گئی۔

"روزانہ کام کرنے والے" کے لیے ٹیرا بھی 20 فیصد سستا ہو گیا، داخلی اور خارجی قیمتیں کر کے 2 اور 12 ڈالر ہو گئیں۔

چینی یوان میں، یہ تقریباً 13.5 یوان اور 81.2 یوان کے برابر ہیں۔

صرف فلگشپ ماڈل Sol اپنی اصل قیمت پر برقرار ہے، لیکن اس کے لیے فاسٹ موڈ شروع کیا گیا ہے جس کی رفتار معیاری موڈ کی 2.5 گنا تک ہے، اور تیزی کے لیے کوئی اضافی فیس نہیں۔

ایجنٹ

کوڈیکس نے اپنے استعمال کو دوبارہ ترتیب دینے کے بعد، قیمتیں بھی فوراً کم کر دی گئیں، اوپن اے آئی، تم کسے دبانے جا رہے ہو…

یہ قیمت کی جنگ براہ راست گرم ہو گئی ہے۔

OpenAI نے کہا کہ کمی کا سبب GPT-5.6 Sol کا خود اپنے لیے پیسے بچانا ہے۔

GPT-5.6 Sol اپنے خود کو بہتر بنانے میں شرکت کر رہا ہے، جس کی وجہ سے اس کی کارکردگی میں طاقتور اضافہ ہوا ہے، اس لیے ہم نئے اور پرانے صارفین کو انعام دے رہے ہیں~

یہ وہی طریقہ ہے جس میں بائیں پاؤں سے دائیں پاؤں پر دباؤ ڈال کر اُڑنا ہوتا ہے، اوپن اے آئی، تم بھی اس کھیل میں شامل ہو گئے

ایجنٹ

۔

دو مصنوعات کی قیمتیں کم، ایک کی رفتار بڑھائی گئی

اب، GPT-5.6 کے تین ماڈلز کی API قیمتیں درج ذیل ہیں:

GPT-5.6 Luna: ہر ملین ٹوکن کے ان پٹ کے لیے 0.2 امریکی ڈالر، آؤٹ پٹ کے لیے 1.2 امریکی ڈالر؛

GPT-5.6 Terra: ہر ملین ٹوکن ان پٹ کے لیے 2 امریکی ڈالر، آؤٹ پٹ کے لیے 12 امریکی ڈالر؛

GPT-5.6 Sol: ہر ملین ٹوکن ان پٹ کے لیے 5 امریکی ڈالر، آؤٹ پٹ کے لیے 30 امریکی ڈالر۔

ایجنٹ

قیمت میں کمی کے بعد، لونا ایک بڑی گرنے والی چیز بن گئی۔

اس کی درج کی گئی قیمت پہلے نسخے GPT-5.4 nano کے برابر ہے، اور آؤٹ پٹ قیمت 0.05 امریکی ڈالر تک سستی ہے۔

لیکن دونوں ماڈلز الگ الگ کام کرتے ہیں، GPT-5.4 nano بنیادی طور پر طبقہ بندی، معلومات نکالنے اور ترتیب دینے جیسے سادہ اور اکثر دہرائے جانے والے کاموں کے لیے ہے۔

GPT-5.6 Luna کو OpenAI نے لاگت حساس کام کے لیے ایک ماڈل کے طور پر ڈیزائن کیا ہے، جو ٹولز کو کال کر سکتا ہے، لمبے کنٹیکس کو سنبھال سکتا ہے، اور متعدد مراحل کے ورک فلوز کو انجام دے سکتا ہے۔

بس اس کا مطلب یہ ہے کہ OpenAI وہ ماڈل جو ایجینٹ کے کام کو چلاتے ہیں، ان کی قیمت پہلے کے سادہ چھوٹے ماڈلز کی قیمت تک لے آرہا ہے۔

ٹیرا نے نسبتاً انکار کیا، 20% کم ہو گیا۔

Sol اپنی اصل قیمت پر رہا، جس میں فاسٹ موڈ شامل کیا گیا ہے، جس کی رفتار معیاری موڈ کی 2.5 گنا ہے، جبکہ قیمت معیاری موڈ کی دو گنا ہے، اور ماڈل کی ذکاوت کا مستوى وہی رہا۔

یہ پہلے کے Priority Processing کو بھی بدل دے گا۔ جو API درخواستیں اب تک priority لیبل استعمال کر رہی تھیں، وہ خودکار طور پر Fast mode پر منتقل ہو جائیں گی۔

افسردہ نے کہا کہ یہ تنظیم Codex اور ChatGPT Work میں بھی داخل ہو جائے گی۔

سابسکرپشن قیمت میں کمی نہیں ہوگی، صارفین کی کل سیٹنگ بھی بڑھائی نہیں جائے گی، لیکن ٹیرا اور لونا کا استعمال کرتے وقت، استعمال ہونے والی سیٹنگ متعلقہ طور پر کم ہو جائے گی۔

ایک ہی سبسکرپشن فیس سے ماڈل کو متعدد بار کام کرنے کی اجازت دی جا سکتی ہے۔

اوپن اے آئی نے چیٹ جی پی ٹی اور کوڈیکس سی ایل آئی میں آٹو ریویو ماڈل کو GPT-5.4 سے GPT-5.6 Luna میں بدل دیا۔

آٹو ریویو پیچھے کی طرف کوڈ اور تبدیلیوں کی جانچ کرتا ہے، جو ایک مثالی اعلیٰ فریکوئنسی ایجنٹ کام ہے۔

ماڈل کے اپ گریڈ اور لونا کی قیمت میں کمی کے ساتھ، اوپن اے آئی کا تخمینہ ہے کہ اس کی لاگت اس کی اصل لاگت کا تقریباً دسواں حصہ ہو جائے گی۔

سستے ماڈل اب صرف طبقہ بندی، نکالنے جیسے روایتی "کام" کے لیے محدود نہیں رہے، بلکہ وہ کوڈ جانچ، بیک اینڈ نگرانی جیسے فیصلے اور ٹولز کے استعمال کی ضرورت والے مراحل میں داخل ہو گئے ہیں۔

اب تین ماڈلز کی پوزیشن یہ ہے:

بجٹ کے لحاظ سے حساس اور زیادہ استعمال والے کامز لونا کو سونپ دیں؛

روزانہ کے عام کاموں کو Terra کو سونپ دیں؛

مشکل ٹاسکس کے لیے اب بھی Sol کا استعمال کریں؛

اگر انتظار کرنے کا بھی وقت نہیں، تو سپیڈ خریدنے کے لیے دوگنا ادائیگی کریں۔

GPT-5.6 اپنے لاگت کم کرنے میں شریک ہو گیا ہے

اچانک کیوں گرا؟

اوپن اے آئی کا کہنا ہے کہ وجوہات GPT-5.6 Sol کے اپنے پیداواری نظام کے بہترین بنانے میں شرکت کی وجہ سے ہیں۔

اس کی بڑھی ہوئی کارکردگی نے قیمت کی فہرست پر ڈسکاؤنٹ کے اعداد و شمار میں تبدیلی لائی۔

خاصة طور پر، GPT-5.6 Sol نے پیداواری ماحول کے کچھ GPU Kernel کو دوبارہ لکھا اور بہتر بنایا، ہundreds ٹوکن جنریشن تجربات ڈیزائن اور چلایا، اور تربیت کی نگرانی میں شرکت کی، جب مسائل پیدا ہوئے تو مداخلت کی۔

آخری کارکردگی بھی نمایاں تھی: GPU Kernel کے آپٹیمائزیشن سے GPT-5.6 کی end-to-end سروس کی لاگت 20% کم ہوئی؛ اور تخمینی ڈیکوڈنگ میں اصلاح سے Token جنریشن کی کارکردگی 15% سے زیادہ بہتر ہوئی۔

ایجنٹ

GPU Kernel کو مدل کے لیے GPU پر عملی حساب کی تھوڑی سی پروگرامنگ کے طور پر سمجھا جا سکتا ہے۔

ماسٹر خود تبدیل نہیں ہوگا، صرف اگر ان پروگرامز کو زیادہ کارآمد طریقے سے لکھا جائے، تو ایک ہی GPU وہی کمپیوٹیشن جلدی سے مکمل کر سکتی ہے، زیادہ درخواستوں کو سنبھال سکتی ہے، اور ہر ایک کال کی لاگت بھی کم ہو جائے گی۔

اندازہ لگانے والی ڈیکوڈنگ میں، جواب تیار کرتے وقت، اگلے ممکنہ ٹوکن کو ایک ساتھ "اندازہ" لگایا جاتا ہے، اور پھر اسے بنیادی ماڈل کی تصدیق کے لیے بھیجا جاتا ہے۔ جتنا زیادہ درست اندازہ لگایا جائے، اتنے ہی کم ایک ایک کر کے تیار کرنے اور انتظار کرنے کے مراحل درکار ہوں گے۔

دونوں بہتریاں مدل کی صلاحیت کو کم نہیں کرتیں، لیکن ایک ہی مدل کو زیادہ تیز اور سستا چلایا جا سکتا ہے۔

تاہم، یہ ابھی تک GPT-5.6 کا خود کو مکمل طور پر اپ گریڈ کرنا نہیں ہے۔

اوپن اے آئی نے خصوصی طور پر زور دیا ہے کہ پوری پروسیس اب بھی انسانوں کے کنٹرول میں ہے۔

ماڈل کوڈ لکھ سکتا ہے، تجربات چلا سکتا ہے، اور غیر معمولی باتوں کی نگرانی کر سکتا ہے، لیکن مقصد کیسے طے کیا جائے، نتائج استعمال کے قابل ہیں یا نہیں، اور کوڈ پروڈکشن ماحول میں جائے گا یا نہیں، اس کے لیے اب بھی "انسان کی موجودگی" ضروری ہے۔

OMT

آخر میں، ایک نیا تبدیلی ہے۔

اس کمی کا ایک خاص نقطہ: ایجینٹ ورک فلو۔

سب سے زیادہ ڈسکاؤنٹ والی لونا صرف طبقہ بندی اور نکالنے کے لیے استعمال ہونے والی روایتی چھوٹی ماڈل نہیں ہے۔

اوپن اے آئی کے مطابق، یہ ٹولز کو کال کر سکتا ہے اور متعدد مراحل کے کاموں کو انجام دے سکتا ہے، جو بنیادی طور پر اعلیٰ فریکوئنسی اور لاگت حساس ورک لود کے لیے ہے۔

اس لیے، لونا کی قیمت 80 فیصد گر گئی، جس سے ایجنٹ کے طویل مدتی چلائے جانے کی سرحدیں کم ہو گئیں۔

جس طرح سے اب تک لاگت کی وجہ سے بار بار نہیں کی جانے والی جانچ، تصدیق اور نگرانی کے کام، وہ اب عمل کا معمولی حصہ بن سکتے ہیں۔

GPT-5.6 کے شرکت سے اپنے پیداواری نظام کو بہتر بنانے کے ساتھ، ایک نیا حلقوں کا سلسلہ ظاہر ہوا:

ماڈل کی شرکت سے آپریشنل کارکردگی میں اضافہ ہوتا ہے، لاگت کم ہوتی ہے؛ قیمت کم ہونے کے بعد، ماڈل زیادہ اعلیٰ فریکوئنسی والے ورکفلوز میں داخل ہوتا ہے؛ کالز کا سائز بڑھنے سے اگلی لہر کی کارکردگی میں بہتری کو فروغ ملتا ہے۔

اوپن اے آئی کا یہ کم کی قیمتوں کا چکر اب اپنا خاکہ پیش کر چکا ہے۔

اس سب کے بعد، اب دباؤ براہ راست A کمپنی پر ہے:

اب تمہاری باری ہے۔

ایجنٹ

حوالہ جات: [1] https://x.com/OpenAI/status/2082878156483219672 [2] https://x.com/sama/status/2082880720989532597

یہ مضمون ویچن گروپ "Quantum Bit" سے ہے، مصنف: سامنے والی ٹیکنالوجی پر توجہ دیں

اعلان دستبرداری: اس صفحہ پر معلومات تیسرے فریق سے حاصل کی گئی ہوں گی اور یہ ضروری نہیں کہ KuCoin کے خیالات یا خیالات کی عکاسی کرے۔ یہ مواد کسی بھی قسم کی نمائندگی یا وارنٹی کے بغیر صرف عام معلوماتی مقاصد کے لیے فراہم کیا گیا ہے، اور نہ ہی اسے مالی یا سرمایہ کاری کے مشورے کے طور پر سمجھا جائے گا۔ KuCoin کسی غلطی یا کوتاہی کے لیے، یا اس معلومات کے استعمال کے نتیجے میں کسی بھی نتائج کے لیے ذمہ دار نہیں ہوگا۔ ڈیجیٹل اثاثوں میں سرمایہ کاری خطرناک ہو سکتی ہے۔ براہ کرم اپنے مالی حالات کی بنیاد پر کسی پروڈکٹ کے خطرات اور اپنے خطرے کی برداشت کا بغور جائزہ لیں۔ مزید معلومات کے لیے، براہ کرم ہماری استعمال کی شرائط اور خطرے کا انکشاف دیکھیں۔