OpenAI تخفيض أسعار واجهات برمجة تطبيقات GPT-5.6 Luna و Terra، وتقدم وضع Sol الأسرع

icon MarsBit
مشاركة
AI summary iconملخص
خفضت OpenAI تكاليف واجهات برمجة التطبيقات لـ GPT-5.6 Luna وTerra، حيث انخفضت رسوم إدخال وإخراج Luna بنسبة 80% لكل منهما، وانخفضت تكاليف Terra بنسبة 20%. الآن يقدم نموذج Sol وضعًا أسرع بـ 2.5 مرة بنفس السعر. تساعد مكاسب الكفاءة من Sol، بما في ذلك الترميز التخميني وتحسينات نواة GPU، في تقليل التكاليف. مع ظهور اتجاهات مؤشر الخوف والطمع على زيادة الثقة في السوق، يمكن أن تعزز هذه الخصومات استخدام وكلاء الذكاء الاصطناعي وتؤثر على ديناميكيات أسعار العملات المشفرة في التداول عالي التردد.

وكيل

يُقدَّم إصدار Luna الأساسي بخصم كبير، حيث انخفض سعر الإدخال لكل مليون رمز من 1 دولار إلى 0.2 دولار، وانخفض سعر الإخراج من 6 دولارات إلى 1.2 دولار.

Translated to CNY, the input price decreased from approximately ¥6.8 to ¥1.35, and the output price decreased from approximately ¥40.6 to ¥8.1.

كما انخفض سعر Terra، المُعرَّف كـ"القوة الرئيسية للعمل اليومي"، بنسبة 20٪، ليصبح سعر الإدخال 2 دولار وسعر الإخراج 12 دولارًا.

Converted to CNY, they are approximately RMB 13.5 and RMB 81.2.

يظل النموذج الرائد Sol بسعره الأصلي، لكنه أطلق وضع Fast mode، الذي يصل سرعته إلى 2.5 ضعف السرعة في الوضع القياسي، مع تسريع دون زيادة في السعر.

وكيل

بعد إعادة ضبط استخدام Codex بشكل كبير، قاموا فورًا بخفض الأسعار، OpenAI، هل تريدين قتل من؟...

这场价格战直接白热化了。

أعلنت OpenAI أن التخفيض نتج عن أن GPT-5.6 Sol قام بترشيد تكاليفه بنفسه.

شارك GPT-5.6 في تحسين نفسه، مما أدى إلى تحسن هائل في الكفاءة، ولذلك نقدم هذه المكافأة للمستخدمين الجدد والقدامى~

هذا الأسلوب من دفع نفسك للارتفاع بالوقوف على قدمك اليسرى، OpenAI، أنت أيضًا بدأت تلعبه

وكيل

.

تخفيضان في السعر، وواحد متسارع

الآن، أسعار واجهة برمجة التطبيقات للنماذج الثلاثة لـ GPT-5.6 هي:

GPT-5.6 Luna: 0.2 دولار لكل مليون رمز إدخال، 1.2 دولار لكل مليون رمز إخراج؛

GPT-5.6 Terra: 2 دولار للإدخال لكل مليون رمز، 12 دولار للإخراج؛

GPT-5.6 Sol: 5 دولارات لكل مليون رمز إدخال، 30 دولارًا لكل مليون رمز إخراج.

وكيل

بعد الخفض السعري، أصبحت Luna انخفاضًا حادًا.

سعر الإدخال الخاص به قد وصل إلى نفس مستوى الجيل السابق GPT-5.4 nano، وسعر الإخراج أرخص حتى بـ 0.05 دولار.

لكن النموذجين لا يؤديان نفس المهام بالكامل، حيث يركز نموذج GPT-5.4 nano على المهام البسيطة والمتكررة مثل التصنيف واستخراج المعلومات والترتيب.

يُعرّف OpenAI GPT-5.6 Luna على أنه نموذج موجه للعبء العمل الحساس من حيث التكلفة، ويمكنه استدعاء الأدوات، ومعالجة السياقات الطويلة، وتنفيذ سير العمل متعددة الخطوات.

ببساطة، تبيع OpenAI النموذج الذي يدعم عمل الوكلاء بأسعار كانت تُستخدم سابقًا للنماذج الصغيرة البسيطة.

Terra متحفظ نسبيًا، بانخفاض قدره 20%.

يظل سعر Sol كما هو، مع إضافة وضع Fast mode، الذي يصل سرعته إلى 2.5 ضعف السرعة في الوضع القياسي، بسعر ضعف الوضع القياسي، مع الحفاظ على نفس مستوى الذكاء للنموذج.

سيستبدل أيضًا معالجة الأولوية السابقة. يمكن لطلبات API التي كانت تستخدم علامة priority التبديل تلقائيًا إلى وضع Fast.

أفادت الشركة أن هذا التعديل سيشمل أيضًا Codex وChatGPT Work.

لن يتم خفض سعر الاشتراك، ولن يتم زيادة إجمالي الحصة للمستخدم، ولكن عند استخدام Terra وLuna، سيتم تقليل الحصة المستهلكة بشكل متناسب.

نفس رسوم الاشتراك تسمح للنموذج بأداء مهام أكثر عدة مرات.

قامت OpenAI أيضًا باستبدال نموذج المراجعة التلقائية في ChatGPT وCodex CLI من GPT-5.4 إلى GPT-5.6 Luna.

Auto-review مسؤول عن التحقق تلقائيًا من الكود ونتائج التعديلات في الخلفية، وهو مثال نموذجي على مهام الوكيل عالية التكرار.

بفضل ترقية النموذج وانخفاض سعر Luna، تتوقع OpenAI أن تنخفض تكاليفها إلى حوالي عشرة أجزاء من قيمتها الأصلية.

لم تعد النماذج الرخيصة مسؤولة فقط عن التصنيف واستخراج هذه المهام التقليدية "الثانوية"، بل بدأت الآن في الدخول إلى مراحل مثل مراجعة الكود ومراقبة الخلفية التي تتطلب تقييمًا واستدعاء الأدوات.

حاليًا، يتم تحديد مواقع النماذج الثلاثة على النحو التالي:

قم بتكليف المهام الحساسة من حيث الميزانية والمتطلبات العالية للطلبات إلى Luna؛

يتم تسليم المهام اليومية العادية إلى Terra؛

استمرار استخدام Sol للمهام الصعبة

إذا كان الانتظار بطيئًا جدًا، فأنفق ضعف المبلغ لشراء سرعة أكبر.

يبدأ GPT-5.6 في المشاركة في خفض تكلفته الخاصة

لماذا انخفض السعر فجأة؟

أعلنت OpenAI أن السبب هو مشاركة GPT-5.6 Sol في تحسين أنظمة الإنتاج الخاصة بها.

الكفاءة التي تم تحسينها تحولت إلى أرقام خصم على جدول الأسعار.

على وجه التحديد، أعاد GPT-5.6 Sol كتابة وتحسين بعض نوى GPU في بيئة الإنتاج، وصمم ونفذ مئات التجارب لإنشاء الرموز، كما شارك في مراقبة التدريب وتدخل عند حدوث مشكلات.

كما كانت النتائج النهائية بارزة: تحسين نواة GPU خفض تكلفة الخدمة端到端 لـ GPT-5.6 بنسبة 20٪؛ وتحسين التخمين في التفكيك، مما زاد كفاءة توليد الرموز بنسبة أكثر من 15٪.

وكيل

يمكن فهم GPU Kernel على أنه البرنامج الأساسي الذي ينفذ مهام الحساب المحددة على وحدة معالجة الرسومات.

لا حاجة لتغيير النموذج نفسه، فقط إذا تم كتابة هذه البرامج بكفاءة أعلى، فسيتمكن نفس وحدة معالجة الرسوميات من إكمال الحسابات بشكل أسرع، ومعالجة طلبات أكثر، وستنخفض تكلفة كل استدعاء.

يتمثل التخمين في التنبؤ المسبق بسلسلة من الرموز المحتملة التي قد تظهر بعد ذلك، ثم إرسالها إلى النموذج الرئيسي للتحقق. كلما كان التخمين أكثر دقة، قل عدد الخطوات التي تحتاج إلى توليدها وانتظارها واحدًا تلو الآخر.

لم تقلل كلا التحسينين من قدرة النموذج، لكنهما جعلا نفس النموذج يعمل بشكل أسرع وأرخص.

لكن هذا ليس ترقية ذاتية كاملة من GPT-5.6.

OpenAI emphasized that the entire process is still human-led.

يمكن للنموذج كتابة الكود، وتشغيل التجارب، ومراقبة الشذوذ، لكن تحديد الهدف، وتحديد ما إذا كانت النتائج قابلة للاستخدام، وما إذا كان الكود سيُدخل إلى بيئة الإنتاج، لا يزال يتطلب وجود "إنسان في الحلقة".

OMT

أخيرًا، هناك تغيير جديد.

هذا الخفض له نقطة تحديد محددة: سير عمل العميل.

أقل نموذج صغير تقليدي يستخدم للتصنيف والاستخراج، ليس فقط لـ Luna.

وفقًا لتحديد OpenAI، يمكنه استدعاء الأدوات وتنفيذ مهام متعددة الخطوات، وهو موجه بشكل رئيسي إلى أحمال العمل عالية التردد وحساسة للتكلفة.

لذلك، انخفض سعر Luna بنسبة 80٪، مما يخفض أيضًا عتبة التشغيل الطويل الأمد للوكيل.

اجعل المهام التي كانت سابقًا غير قابلة للتنفيذ المتكرر بسبب تكلفتها العالية، تصبح خطوات روتينية في سير العمل.

بالإضافة إلى مشاركة GPT-5.6 في تحسين نظام الإنتاج الخاص به، ظهر دورة جديدة:

مشاركة النموذج تزيد كفاءة التشغيل وتخفض التكاليف؛ بعد انخفاض السعر، يدخل النموذج مزيدًا من سير العمل عالية التردد؛ وتوسيع حجم الاستدعاء يدفع موجة جديدة من تحسين الكفاءة.

عجلة تخفيضات OpenAI قد ظهرت بالفعل في شكلها الأولي.

بعد كل هذه الإجراءات، أصبح الضغط الآن على الشركة A:

دورك الآن.

وكيل

روابط مرجعية: [1] https://x.com/OpenAI/status/2082878156483219672 [2] https://x.com/sama/status/2082880720989532597

هذا المقال من حساب ويشات الرسمي "كيوانغ تشي"، المؤلف: متابع التكنولوجيا المتقدمة

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.