
Giriş seviyesi Luna, her milyon Token için giriş fiyatı 1 dolarlardan 0,2 dolara, çıkış fiyatı 6 dolarlardan 1,2 dolara düşürüldü.
Çin yuanına çevrildiğinde, giriş fiyatı yaklaşık 6,8 yuan'dan 1,35 yuan'a düşerken, çıkış fiyatı yaklaşık 40,6 yuan'dan 8,1 yuan'a düşüyor.
Günlük işlerin ana gücü olan Terra da %20 indirimle, girdi ve çıktı fiyatları sırasıyla 2 dolar ve 12 dolara düşürüldü.
Çin yuanına çevrildiğinde sırasıyla yaklaşık 13,5 yuan ve 81,2 yuan eder.
Yalnızca flagman model Sol, fiyatında sabit kalırken, Fast modu başlatıldı ve hızı standart moda göre en fazla 2,5 kat artırıldı; hızlanma ek ücret olmadan.

Codex'in yoğunluklarını büyük ölçüde sıfırlamasından sonra fiyat indirimi de hemen uygulandı, OpenAI kiminle rekabet etmeye çalışıyorsun…
Bu fiyat savaşı doğrudan aşırı derecede ısındı.
OpenAI, fiyat düşüşünün GPT-5.6 Sol'un kendi kendine para tasarrufu sağlaması nedeniyle olduğunu belirtti.
GPT-5.6 Sol, kendi gelişimine katkıda bulunarak verimlilikte sıçrama yaptı; bu nedenle yeni ve eski kullanıcılara özel bir geri ödeme sunuyoruz~
Sol ayakla sağ ayağı basarak yerde yükselmek bu tarzı, OpenAI sen de yapmaya başladın

.
İki tanesi indirimde, bir tanesi hızlanıyor
Şu anda, GPT-5.6'nın üç modelinin API fiyatları şunlardır:
GPT-5.6 Luna: Girdi başına milyon Token 0,2 dolar, çıktı başına 1,2 dolar;
GPT-5.6 Terra: Girdi başına milyon Token başına 2 dolar, çıktı başına 12 dolar;
GPT-5.6 Sol: Girdi başına milyon Token başına 5 USD, çıktı başına 30 USD.

Fiyat düşüşünden sonra Luna, büyük bir düşüş yaşadı.
Giriş fiyatı, önceki nesil GPT-5.4 nano ile aynı seviyede, çıkış fiyatı ise 0,05 dolar daha ucuz.
Ancak iki model tamamen aynı işleri yapmaz; GPT-5.4 nano çoğunlukla sınıflandırma, bilgi çıkarma ve sıralama gibi basit ve sık tekrarlanan görevler için yöneliktir.
GPT-5.6 Luna, OpenAI tarafından maliyet duyarlı iş yükleri için tasarlanmış, araç çağırabilen, uzun bağlamları işleyen ve çok adımlı iş akışlarını gerçekleştiren bir model olarak tanımlanmıştır.
Kısaca, OpenAI, Agent'ların çalışmasını sağlayan modeli, geçmişteki basit küçük modellerin fiyatlarına satıyor.
Terra, %20 düşüşle nispeten sakin kaldı.
Sol, fiyatında değişiklik yapılmadan Fast modu ekledi; hızı standart modun en fazla 2,5 katı, fiyatı ise standart modun iki katı, model akıllılık seviyesi aynı kaldı.
Ayrıca daha önceki Priority Processing'i de yerine geçecektir. Önceden priority etiketi kullanılan API istekleri, otomatik olarak Fast moduna geçecektir.
Resmi açıklama, bu ayarlamanın Codex ve ChatGPT Work'a da gireceğini belirtti.
Abonelik fiyatı düşürülmeyecek ve kullanıcıların toplam kotası artırılmayacak, ancak Terra ve Luna çağrıldığında tüketilen kota karşılıklı olarak azalacaktır.
Aynı abonelik ücretiyle model daha fazla iş yapabilir.
OpenAI, ChatGPT ve Codex CLI'deki otomatik inceleme modelini GPT-5.4'ten GPT-5.6 Luna'ya değiştirdi.
Auto-review, arka planda kodu ve değişiklik sonuçlarını kontrol etmekten sorumludur ve tipik bir yüksek frekanslı Agent görevidir.
Model yükseltmesi ve Luna fiyat düşüşüyle birlikte, OpenAI maliyetlerinin yaklaşık onda birine düşmesini bekliyor.
Ucuz modeller artık sınıflandırma ve çıkarım gibi geleneksel "sıradan işler"le sınırlı kalmıyor, kod incelemesi ve arka plan izleme gibi değerlendirme ve araç çağrısı gerektiren aşamalara girmeye başlıyor.
Şu anda üç modelin konumu şudur:
Bütçe duyarlı, yüksek talepli görevleri Luna'ya bırakın;
Terra'ya günlük görevleri bırakın;
Yüksek zorlukta görevler hâlâ Sol kullanılarak devam edecektir;
Beklemek bile yavaşsa, hızı almak için iki kat para harcayın.
GPT-5.6, maliyetini azaltmaya başlıyor
Neden ani bir indirim?
OpenAI, nedenin GPT-5.6 Sol'un kendi üretim sisteminin optimizasyonuna katılması olduğunu belirtti.
Artırılan verimlilik, fiyat listesindeki indirim rakamlarına dönüştü.
Özellikle GPT-5.6 Sol, üretim ortamındaki bazı GPU çekirdeklerini yeniden yazdı ve optimize etti, yüzlerce token üretimi deneyimi tasarladı ve çalıştırdı ve eğitim sürecini izledi, sorunlar ortaya çıktığında müdahale etti.
Sonuçlar da dikkat çekiciydi: GPU Kernel optimizasyonu sayesinde GPT-5.6'nın uçtan uca hizmet maliyeti %20 azaldı; tahmini dekodlama geliştirilerek Token üretimi verimliliği %15'ten fazla arttı.

GPU Kernel, modelin GPU üzerindeki belirli hesaplama görevlerini gerçekleştiren alt seviye programıdır.
Model değişmeden, bu programlar daha verimli yazıldığında, aynı GPU daha hızlı hesaplama yapar, daha fazla isteği işler ve her bir çağrı maliyeti de düşer.
Tahmini kod çözme, cevap üretirken sonraki olası Token'ları önceden topluca «tahmin edip», ardından ana model tarafından doğrulatmaktır. Tahminler ne kadar doğruysa, tek tek üretip beklemek zorunda kalınan adımlar o kadar azalır.
İki optimizasyon da model kapasitesini düşürmeden, aynı modelin daha hızlı ve daha ucuz çalışmasını sağlıyor.
Ancak bu, GPT-5.6'nın tamamen kendi kendini yükseltmesi değildir.
OpenAI, sürecin hâlâ insan kontrolünde olduğunu vurguladı.
Modeller kod yazabilir, deneyler çalıştırabilir ve anomaliyi izleyebilir, ancak hedefler nasıl belirlenecek, sonuçlar kullanılabilir mi, kod üretim ortamına girer mi, hâlâ 'İnsanın Döngüde Olması' gerektirir.
OMT
Son olarak, bir başka yeni değişiklik var.
Bu indirim, özellikle Agent iş akışı üzerinde odaklanmaktadır.
En çok indirimli Luna, sadece sınıflandırma ve çıkarma için kullanılan geleneksel küçük modeller değildir.
OpenAI'nin konumuna göre, araçları çağırabilir ve çok adımlı görevleri gerçekleştirebilir; ana hedefi yüksek frekanslı ve maliyet duyarlı iş yükleridir.
Bu nedenle, Luna'nın %80 değer kaybetmesi, Agent'in uzun vadeli çalıştırılma engelini de düşürüyor.
Yüksek maliyet nedeniyle önce sık sık yürütülemeyen inceleme, doğrulama ve izleme görevlerini iş akışının düzenli adımları haline getirin.
GPT-5.6 ile birlikte kendi üretim sistemini optimize ederek yeni bir döngü ortaya çıktı:
Model katılımı, operasyonel verimliliği artırır ve maliyetleri düşürür; fiyatlar düştükçe model, daha fazla yüksek frekanslı iş akışına dahil olur; çağrı hacmi genişledikçe, bir sonraki verimlilik iyileştirme döngüsü tetiklenir.
OpenAI'nin bu fiyat indirim döngüsü zaten şekil almaya başlamıştır.
Bu işlemler sonucunda artık baskı tamamen A şirketine geliyor:
Sıra sizde.

Referans bağlantıları: [1] https://x.com/OpenAI/status/2082878156483219672 [2] https://x.com/sama/status/2082880720989532597
Bu yazı, WeChat hesabından "Quantum Bit" tarafından yazılmıştır, yazar: Öncü teknolojilere takip eden
