Kapalı Yapılı Yapay Zeka Modelleri, 2026'da açık ağırlıklı modelleri 29 Elo puanla geride bırakıyor

iconCryptoBriefing
Paylaş
AI summary iconÖzet
Eylül 2026'dan AI ve kripto haberleri, kapalı AI modellerinin artık açık ağırlıklı modelleri 29 Elo puanla geçtiğini gösteriyor. Arena AI verileri, Claude Opus 5 Max'ı 1505 puanla sıralarken, Moonshot AI'nin Kimi K3 Max'ı neredeyse 30 puan geride bırakıyor. Bu fark, açık modellerin karmaşık görevlerde dört aylık bir gecikmeye sahip olduğunu yansıtmaktadır. Enflasyon verisi trendleri, bu AI performans değişimine doğrudan etki etmiyor.

Ocak 2025'te kısa ama güzel bir an için, açık kaynaklı AI modelleri kapalı kaynaklı rakiplerine yetişti. Arena'nın halka açık liderlik tablosundaki Elo puan farkı sıfıra düştü. Eşitlik.

O an geçti. Eylül 2026 itibarıyla, en iyi kapalı ön plan modeli ile en güçlü açık ağırlıklı rakibi arasındaki fark, Arena AI’nın değerlendirme verilerine göre 29 Elo puanına ulaştı. Claude Opus 5 Max, 1505 puanla yer alırken, en güçlü açık ağırlıklı rakip olan Moonshot AI’nin Kimi K3 Max, neredeyse 30 puan geride kalıyor. Arena’nın Yapay Zeka Kapasitesi Sorumlusu Peter Gostev, bu ayrımın izlenmesi ve görselleştirilmesinde merkezi bir rol oynadı.

Reklam

Sayıların aslında ne anlama geldiğini

Yörüngeler, tek bir anlık görüntüden daha ilginç bir hikâye anlatır. Ocak 2025'te sıfırdan başlayıp Eylül 2026'da 29 puana ulaşan eğilim çizgisi, açık ağırlıklı savunucular için yanlış yönde ilerliyor. Epoch AI'nın analizi, bu resmi farklı bir açıdan pekiştiriyor: Açık ağırlıklı modeller, en zor görevlerde artık kapalı ağırlıklı modellerden yaklaşık dört ay geride. Bu fark, 2025'in sonlarına kadar gözlemlenen üç aylık farktan arttı.

Arena, aylık 10 milyondan fazla değerlendirme gerçekleştiriyor ve sentetik testler yerine gerçek kullanıcı etkileşimlerinin büyük bir havuzundan yararlanıyor. Milyonlarca anonim kullanıcı, bir modelin çıktılarını diğerinin üzerine tutarlı bir şekilde tercih ederse, bu sinyali görmezden gelmek zorlaşır.

Yapay zekayı ölçmenin işi

Arena, kendi başına ilgi çekici bir iş hikayesi haline geldi. 2023 yılında UC Berkeley'de bir araştırma projesi olarak başlayan bu girişim, yıllık 100 milyon dolarlık gelir elde eden bir işletmeye dönüştü. Ücretli değerlendirme hizmetlerini başlatmasından sadece sekiz ay sonra bu gelir seviyesine ulaştı.

Gostev’in özel katkısı, modellerin zayıf yönlerini açık hale getirmeye odaklanmıştır. Çalışmaları, modellerin alan uzmanları tarafından değerlendirildiğinde ve genel kullanıcılar tarafından değerlendirildiğinde gösterdikleri performans arasındaki gerilimi vurgulamaktadır; bu ayrım, kurumsal uygulamalar için büyük önem taşımaktadır.

Açık modellerin coğrafi politikası

En aktif açık ağırlıklı model geliştirme, büyük ölçüde Çinli laboratuvarlara kaymıştır. Moonshot AI’nin Kimi serisi, Zhipu’nun GLM’si, DeepSeek ve Alibaba’nın Qwen’i, kamuoyuna açık olanın öncüleri temsil etmektedir. Ancak boşluk hâlâ devam etmektedir. Anthropic, OpenAI ve Google DeepMind, kendi kapalı modellerini daha da ileriye, daha hızlı itmeye devam etmektedir.

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.