OpenAI, fiyatlandırma stratejisini ayarlıyor ve rutin görevler için daha düşük maliyetli modelleri öneriyor

icon MarsBit
Paylaş
AI summary iconÖzet
OpenAI, AI modelleri için fiyatlandırmayı büyük ölçüde düşürdü; GPT-5.6 Luna modeli %80, Terra modeli ise %20 indirimle sunuluyor. Şirket, kullanıcıları rutin görevler için daha ucuz modelleri tercih etmeye teşvik ediyor ve üst düzey modelleri karmaşık işler için saklıyor. Bu değişim, üst düzey modellerin ticari uygulamalardan ziyade yetenekleri sergilemek için daha çok kullanıldığı bir eğilimle uyumlu. Anthropic’ın Claude Opus 5, Fable 5 modelinin maliyetinin yarısıyla neredeyse bayrak seviyesi performans sunuyor. Traderlar, bu durumun korku ve açgözlülük endeksini ve sonraki izlenecek altcoinleri nasıl etkileyeceğini izliyor.

OpenAI

Bugün hâlâ OpenAI'nin en güçlü modelini çağırmak için en çok parayı harcayanlar varsa.

OpenAI aksine, ona başka birini önerir.

30 Temmuz'da OpenAI, bir fiyat调整 duyurusu yayınladı.

GPT-5.6Luna modeli %80 indirimle, Terra modeli %20 indirimle.

Bu mesajı görünce,硅谷'in fiyat savaşına başlamaya odaklanmak kolaydır.

Ancak, resmi olarak yayınlanan teknik belgeleri ve API çağırma kılavuzlarını dikkatlice inceledikten sonra, gerçekten dikkat edilmesi gereken hareketin fiyat rakamlarında değil, başka yerlerde olduğunu anlayacaksınız.

Bu, temelde OpenAI'nin kullanıcılarına ilk kez birçok görevin aslında en güçlü modeli gerektirmeden yapılabileceğini söylemesidir.

Resmi bir öneride bulunuldu. Karmaşık bir görevse, önce GPT-5.6Sol ile ihtiyaç analizi ve çözüm tasarımı yapın, ardından Luna'ya uygulama, kod yazma ve test çalıştırma görevini verin.

En pahalı model düşünmeyi, en ucuz model işi yapmayı sorumlu tutar. Bu strateji iki yıl önce ticari bir self-inkâr olarak görülürdü.

Bilmeniz gereken, geçmişte tüm AI endüstrisinde herkes kendi modelinin en akıllı olduğunu pazarda sürekli vurgulamıştı.

Bugün sonuç olarak, OpenAI en pahalısını her zaman almanıza gerek olmadığını söyledi.

Bu olay, indirimden çok daha önemli.

Birinci: Silicon Valley'nin iki büyüklerinin uyumu

Son iki haftada neler olduğunu önce inceleyin.

30 Temmuz'da OpenAI fiyatlarını ayarladı. Luna %80 indirim aldı. Terra %20 indirim aldı. Sol, fiyatında değişiklik yapmadı; yerine Fast modunu ekledi, bu mod standart moda göre en fazla 2,5 kat daha hızlı olabilir, fiyat iki katına çıkmıştır ancak akıllılık seviyesi tamamen aynıdır.

Üst düzey modeller korunmaya devam ediyor. Gerçek hacim artışı, orta ve düşük seviyelerde başlıyor.

Bir önceki hafta.

24 Temmuz'da Anthropic da neredeyse aynı şeyi yaptı. Claude Opus 5 yayınlandı, milyon token girdi 5 dolar, çıktı 25 dolar. Tam olarak Fable 5'in yarısı.

Performans atılımından ziyade, Anthropic ekonomiklik vurgusunda bulunuyor: Fable 5'e neredeyse tamamen eşit ileri çıkarım yeteneklerini fiyatın yarısıyla elde edebilirsiniz.

Bir ay önce Fable 5, Anthropic'ın vurguladığı öncü ürün idi: En güçlü akıl yürütme, en uzun bağlam, en yüksek fiyat. Ancak bir ay sonra Anthropic, kendi öncü ürününün yarısı fiyata bir alternatifini sundu.

Sadece biri bunu yapıyorsa, ürün ayarı olarak anlaşılabilir. İki tanesi neredeyse aynı anda yapıyorsa, bu rastlantı değil.

Hepsi, kilit modelin önemini aktif olarak azaltmaya başladı.

İkinci: Ana sponsorlar platformu yönetir, hacim sorumluları kazanç sağlar

Sonra neden tam olarak şimdi olduğunu düşündüm.

Cevap aslında basit.

Önceki üst düzey modellerin en büyük değeri, para kazanmak değil, teknolojik öncülüğü kanıtlamaktı. GPT-4 çıktıktan sonra OpenAI'nin değerlemesi sürekli yükseldi. Claude her güncellendiğinde, Anthropic kendi teknolojik konumunu yeniden tanımlıyordu. Üst düzey modeller, marka değeri taşımaktadır.

Ancak şirketlerin gerçekten para harcadığı yer burası değil.

Bir şirket her gün milyonlarca API çağrısı gerçekleştiriyor. Müşteri hizmetleri, arama, onay, kod üretimi ve Agent yürütme gibi yüksek frekanslı görevler, Token tüketiminin büyük bir kısmını oluşturuyor. Kurumsal satın alımların en önemli endişesi, benchmark'da birinci olmak değil, bir görevin maliyeti, yeterli kadar istikrarlı olup olmadığı ve ROI'nin yüksek olup olmadığıdır.

Çağrılmanın ölçeği günlük on milyonlara ulaştığında, lider modelin küçük akıllılık avantajı, devasa hesaplama maliyetleriyle anında yok olur.

OpenAI'nin hareketleri ve açıklamaları bir dönüm noktasını işaret ediyor: üst düzey başlıca ürün artık kazanç yükümlülüğü taşımıyor.

Üç: AI, "kitlesel araç" dönemine giriyor

Bu sahne, otomobil endüstrisi daha önce yaşamıştı.

Yirmi yıl önce, 7 Serisi BMW'nin yüksekliğini tanımladı, S Sınıfı Mercedes'in lüks tonunu belirledi ve A8 Audi'nin üst düzey model imajını kurdu; üst düzey modeller markanın sınırlarını belirler. Ancak markaların satışlarını destekleyen ve kâr elde eden temel pazar her zaman BMW 3 Serisi, Mercedes C Sınıfı ve Audi A4 olmuştur.

Daha sonra daha da belirgin hale geldi. Model S, Tesla'nın araba üretebileceğini kanıtladı. Gerçekten de onu küresel bir otomobil üreticisine dönüştüren, Model 3 ve Model Y oldu.

Lüks modeller yetenek kanıtlamayı, yaygın modeller ölçeklemeyi sağlar.

AI bugün bu aşamaya da girmeye başladı. Sol ve Fable devam edecek ve teknik sınırları zorlayacak, Benchmark'ları yenilecek. Gerçekten ticarileşmeyi üstlenecek olanlar giderek Luna, Terra, Opus olacak.

OpenAI bu sefer hatta önerilen süreci açıkça yazdı, Sol planlamayı, Luna uygulamayı üstlendi.

Bu artık bir model değil, OpenAI bir model görev dağılımı tasarlıyor. Gelecekte şirketler bir model değil, tam bir model sistemi satın alacak. Gerçek maliyeti belirleyen, baş mimar değil, her gün çalışan inşaat ekipleri.

Dört: Model, modeli optimize etmeye başlıyor

Bir başka detay, indirimden daha ilginç olduğunu düşünüyorum.

OpenAI, teknik açıklamasında bu indirimin yalnızca daha fazla GPU satın alınmasından veya ölçeklenmeden kaynaklanmadığını, ancak modelin kendisinin model optimizasyonuna dahil olmaya başlamasından kaynaklandığını belirtti.

Özellikle, insan mühendislerin liderliğinde, Sol alt yapı üretim çekirdeğini kendi kendine yeniden yazdı ve optimize etti. Kendi kendine yüzlerce deney tasarladı, Token üretimi verimliliğini artırdı ve hatta model eğitim sürecini izlemeye katıldı; sorunları tespit ettikten sonra doğrudan müdahale etti.

Sonuç olarak, uçtan uca işletim maliyetleri %20 azaldı ve Token üretimi %15 daha verimli hale geldi.

Bu mesaj kolayca gözden kaçabilir, ancak büyük bir anlam taşır.

Geçmişte verimliliği artırmak mühendislerin işiydi. Model canlı olduktan sonra, insan bir Nokta Nokta İşlem çerçevesini, CUDA'yı, önbellek stratejilerini ve zamanlama algoritmalarını optimize edin. Bir yıl içinde %10'ların üzerinde bir verimlilik artışı elde etmek zaten iyi bir sonuçtur.

Teknolojik ilerleme yeni bir yol izliyor. Modeller, temel kod ve hesaplama kaynakları yönetimi için mühendislik optimizasyonlarını üstlenerek 24 saat boyunca sürekli olarak güncelleniyor.

Bu, sürekli hızlanan bir döngüdür. Model ne kadar akıllıysa, optimizasyona katılım gücü o kadar güçlü olur. Optimizasyon ne kadar hızlıysa, maliyet o kadar hızlı düşer. Maliyet ne kadar düşükse, çağrı miktarı o kadar artar. Çağrı miktarı ne kadar fazlaysa, daha fazla veri üretir ve modelin eğitimine devam edilir.

OpenAI'nin son iki buçuk yıldaki fiyat değişimlerine baktım. GPT-4, başlangıçta 30 dolar / milyon token olarak sunuldu, GPT-4o ile bu fiyat 5 dolara düştü, GPT-4o mini ise 0,15 dolara indi. Bugün Luna'nın fiyatı, eski mini'nin ucuz aralığına yakındır, ancak genel akıllılık seviyesi, iki yıl önceki pahalı GPT-4'ü çoktan geride bırakmıştır.

İki yıldan fazla bir sürede, fiyat yaklaşık iki basamak düşmüştür. Model kendini sürekli optimize etmeye devam ederse, bu eğri muhtemelen aşağı doğru inmeye devam edecektir.

Bugün fiyatın %80 düşmesi değil, maliyetin düşüşünün kendi kendini sürdürülebilir hale gelmesi gerçekten korkutucu.

Beşinci: Kim En Akıllıysa, Kim En Değerli

Gittikçe daha çok hissediyorum ki, bugün insanlar AI rekabetini tartışırken bazen önceki aşama çerçevesini hâlâ kullanıyorlar.

Örneğin, sıkça şu soruyu da sorarlar: Kim en zeki? GPT, Claude, Gemini, DeepSeek Yeni bir model yayınlandığında, medya hemen sıralamaya bakar. Kim birinci, o kazanır.

Ancak OpenAI ve Anthropic'in yeni adımları bu kuralı bozuyor ve piyasaya yeni bir sinyal veriyor: tekil performans şampiyonluğunun çekiciliği azalmaktadır.

OpenAI, duyuruda, geliştiricilerin görevlerin önemini, hata maliyetini, aciliyetini ve ölçeğini göz önünde bulundurarak farklı modelleri eşleştirmelerini önerdi.

Dikkat, burada model değil, görevden bahsediliyor.

Geçmişte bir şirket AI kurduğunda genellikle yalnızca bir seçenek vardı. Bugün itibarıyla ise更像是 bir organizasyon kurmak gibi. En önemli görevler Sol'a, günlük yürütme işlemleri Luna'ya bırakılıyor, ileride daha hafif modeller daha basit işleri üstlenebilir.

Bu, bulut hesaplamanın başlangıcına çok benziyor. Kimse tüm verileri en pahalı SSD'ye koymaz. Sıcak veriler SSD'ye, orta veriler HDD'ye, soğuk veriler ise nesne depolamaya yerleştirilir. Tartışılan her zaman hangi diskin en hızlı olduğu değil, sistemin nasıl en ekonomik şekilde kurulacağıdır.

DeepSeek Aslında Silicon Valley'den daha önce bu yöne yöneldi. Geçen altı aydır, kendisini kesinlikle dünyanın en akıllısı olarak vurgulamadı; sadece birkaç kelimeyi tekrarladı: ucuz, yeterince hızlı, yeterince iyi.

Önbellek vurduktan sonra milyon Token başına maliyet neredeyse göz ardı edilebilir düzeyde düşüyor. Bu, şirketlerin dünya şampiyonu değil, en yüksek toplam ROI'ye sahip kurulum seçeneğini istediğini varsayıyor.

Bu geçici bir fiyat savaşı değil; şu anda iki Silicon Valley devinin takibi, bu ticari yolun kaçınılmazlığını doğrulamaktadır.

Altıncı: OpenAI'nin gerçekten satmak istediği, model değil

Bugün itibarıyla OpenAI'nin stratejisi çok net: Gerçekten satmak istediği, model değil, çağrı miktarı.

Geçmişte model üreticileri yüksek teknoloji primiyle yüksek marj elde ediyordu, şimdi işletme mantığı çok düşük bir eşikle süper ölçekli bir trafik ekosistemi kazanmaya dönüştü.

Microsoft, Windows'un pahalı satılmasından değil, tüm bilgisayarlara Windows'un kurulmasından gerçekten para kazanır. AWS, tek bir sunucunun kârı yüksek olduğundan değil, dünya çapında her gün sayısız uygulamanın üzerinde çalışmasından para kazanır.

Platform geliri, hiçbir zaman nüfus oranına dayanmaz.

Bu, Sol'un fiyatının neden hareketsiz kaldığını açıklıyor. Sol, markayı taşıyor ve OpenAI'nin hâlâ teknolojik açıdan en üst seviyede olan şirket olduğunu kanıtlıyor. Luna ise gelir motoru.

OpenAI, geliştiricilerin yeni bir varsayılan alışkanlık oluşturmasını istiyor: Agent yazmak için Luna'yu, iş akışlarını çalıştırmak için Luna'yu, toplu yürütme için de Luna'yu kullanın. Sadece gerçekten zor problemlerle karşılaştığınızda bir kez Sol'u çağırın.

Bu varsayılan durum kurulduktan sonra, rekabet çok zor hale gelir. Bir şirketin temel modelini değiştirmesi, tüm iş akışını yeniden test etmek, doğrulamak ve uyumlandırmak anlamına gelir. Göç maliyetleri giderek artacaktır.

Gerçek bir koruma duvarı, yetenek önceliğinden ekosistem bağlılığına geçmeye başlamıştır.

Yedinci: Süper model, artık yön belirlemiyor

Uzun vadeli bakıldığında, AI endüstrisi son derece tipik bir ölçek ekonomisi dönüm noktasından geçiyor.

Birim hesaplama maliyeti çok düşük seviyelere indiğinde, token için toplam talep, birim fiyatın düşmesiyle azalmadı, aksine üssel bir şekilde patladı.

Yetenekli modeller artık yön belirlemiyor, çünkü teknolojik ilerlemenin odak noktası akıllılık sınırını araştırmaktan, hesaplama kapasitesinin endüstriyel maliyet düşürmeye kaydı. API çağrısı maliyeti ihmal edilebilir seviyeye indiğinde, modellerin biçimi ve sınırları yavaş yavaş bulanlaşmaya başlayacak.

Kurumsal geliştiriciler, her bir tokenin tüketimini ayrı ayrı izlemek yerine, AI'yı her iş sürecine sorunsuz şekilde entegre ediyor.

Bu dönüşümün en derin yönü, API fiyatlarındaki çöküşün tüm yazılım mühendisliği taşınma maliyetini artırmasıdır. Bir şirketin iş akışları, Agent tahsis ağları ve otomatik veri boruları tümü düşük maliyetli modellerin kombinasyonuna dayanır hale geldiğinde, altta yatan model sağlayıcıları gelecek on yılın hesaplama borularını kilitler.

Geçtiğimiz yıllarda büyük modeller şirketleri akıllılık satıyordu. Bugün itibarıyla ise verimlilik satmaya başlıyorlar.

Bu tamamen farklı iki hikaye.

【Sayfa Dışı】:

Geçmişte, AI gelişimini tüketim elektroniğiyle karşılaştırıp ara sıra rekor kıracak yeni bir bayrak gemisi beklemeyi alışkanlık haline getirdik.

Ancak belki de AI'nın gerçek zafer biçimi, bir şöhret yaratan bir ürün olmak değildir.

Buhar makinesi icat edildiğinde, insanlar üretkenliğine hayran kalıyordu; bugün ise elektrik, tüm medeniyetin çalışmasını sağlayan her yerde akıyor, ancak artık kimse onu özel olarak tartışmıyor.

İnsanlar bir üst modelin hangi zeka skorunu yenilediğine dair çılgınca tartışmayı bıraktığında, AI her sisteme, her komuta sessizce gömüldü ve tüm otomasyon süreçlerinin arkasında varsayılan bir su ve elektrik haline geldi.

Onun gerçek dönemi henüz başlıyor.

Bu yazı WeChat public account "Panelin Dışında" tarafından paylaşılmıştır, yazar: Çizim

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.