AI büyük modellerinin akıllılık seviyeleri hızla yükseliyor, Kimi K3, 57 puanla küresel üçüncü açık kaynak model oluyor; ilk 20 modelin medyan puanı 34'ten 43'e yükseliyor. AI altyapı sınırlamaları ortaya çıkıyor, Blackwell GPU kiralama ücretleri yıl başından bu yana %27 arttı, Çin'in öncü modellerinin fiyatlandırılması bir haftada %45 zıpladı, SpaceX ve diğer laboratuvarlar 1 milyar dolarlık elektrik üretme ekipmanları satın aldı. Citi, bir sonraki rekabet avantajının hesaplama gücü elde etmekten verimlilik ve özel verilere geçeceğini belirtiyor; güvenlik riskleri aynı zamanda artıyor, bağımsız AI ajanları artık "öğle yemeğini kesmek"ten "Hugging Face altyapısına nüfuz etmeye" yükseldi.Yazar, Kaynak: Hard AI
Citigroup analizine göre, yapay zeka sektöründeki yatırım getirisi (ROI), altyapı katmanına doğru hızla kaymaktadır; geleceğin rekabet avantajı, hesaplama gücü elde etmekten verimlilik ve özel verilere geçecektir.
Yapay zeka büyük modelleri giderek daha akıllı hale geliyor, ancak onları taşıyan fiziksel dünya sınırına getiriliyor.
Citigroup, 24 Temmuz'da yayınladığı en son raporunda, Ay'ın Karanlık Yüzü Kimi K3'ün 57 puanla küresel olarak üçüncü olduğini ve kapalı kaynak lideri Claude Fable'den sadece 3 puan geride kaldığını yazdı. Aynı zamanda, Kimi K3 temsilindeki Çin'in önde gelen modellerinin haftalık fiyatlandırması %45 zıpladı, Blackwell GPU kiralama ücretleri yıl başından bu yana %27 arttı ve bazı laboratuvarlar 1 milyar dolar harcayarak doğrudan elektrik ünitesi satın aldı.
Citibank analizine göre, yapay zeka sektöründeki yatırım getirisi (ROI), altyapı katmanına doğru hızla kaymaktadır; ve bir sonraki aşama için model rekabetinin koruması, sadece "hesaplama gücü elde etme" yerine "verimli çıktı ve özel veri"ye tamamen geçecektir.
01 Fark sadece 3 dakika kaldı
Citigroup'in raporunda, Kimi K3'ün şu ana kadar yayınlanan en büyük açık kaynak modeli olduğu belirtilmiştir. Birkaç hafta önce en yüksek açık kaynak puanı 51 (Z.ai GLM-5.2) idi; Kimi K3, Claude Fable 5 (60) ve OpenAI GPT-5.6 Sol (59) ardından 57 puana yükseldi.
Tüm sektör hızlanıyor. Önceki altı hafta önceki 34 puanlık en büyük 20 model sağlayıcısının ortanca akıllılık puanı, 43 puana yükseldi. Açık kaynak ekosisteminde, DeepSeek V4 Pro (44 puan), her milyon token için fiyat olarak sadece 0,03'e kadar düşüyor — ön uç akıllılık seviyesine ulaşırken, fiyat olarak iki sıralama basamağı daha düşük.
Kapalı kaynaklı ekip de hızını azaltmadı. Google, Gemini 3.6 Flash’ı (21 Temmuz) yayınladı ve Gemini 3.5 Pro’nun hâlâ test aşamasında olduğunu, Gemini 4’ün ön eğitimine başlandığını duyurdu—üç nesil model aynı anda ilerliyor. Ancak Citigroup, 'Flash önde, Pro geride' olan bu yayın ritminin, öncü modellerin geliştirilmesinin artık daha zorlaştığını gösterdiğini düşünüyor—bu durum, diğer şirketlerin altyapı inşasında yaşadığı gecikmelerle uyumlu ve sektörün teslim süresini kısaltma arzusunun ancak gerçekleştirememesi durumunu yansıtmaktadır.
Model ne kadar büyük ve güçlü olursa, çalıştırılması için gereken kaynaklar o kadar hızla artar.
02 Sıkışma noktası taşındı
Trilyonlarca parametreli model, "hesaplama gücü" kavramını yeniden tanımlıyor.
Citigroup, bu aşırı büyük modellerin gerçek zamanlı çalıştırılması sırasında, matris işlemleri yerine, ağırlıklar ve KV-cache verilerinin HBM belleği ile GPU bağlantı ağı arasında taşınmasına giderek daha fazla zaman harcandığını belirtti. Sınır, "hızlı hesaplayabilmek" (FLOPs) değil, "taşıyabilmek" — yani bellek bant genişliği, GPU bağlantıları ve elektrik sağlanması — haline geldi.
GPU talebi hâlâ yüksek ve Blackwell mimarisi kira ücretleri bu yıl başından beri %27 arttı. Ancak sadece GPU sayısını artırmak yeterli değil.
Bazı laboratuvarlar doğrudan üst akış elektrik üretimiye giriyor: SpaceX, 1 GW hareketli türbin ünitesi satın almak için 1 milyar dolar harcıyor (15 Temmuz), Georgia Power aynı hafta hizmet anlaşması imzalıyor (22 Temmuz). AI laboratuvarları elektrik üretme ekipmanları satın alıyor—bir yıl önce neredeyse hayal edilemeyen bir şey, şimdi gerçekleşiyor.
Model fiyatlaması, kapasitenin ne kadar sıkıldığını doğrudan yansıtır. Çin'in öncü modellerinin karışık fiyatlaması, milyon token başına 0,87'ye sıçradı; haftalık ve aylık bazda %45 artış göstererek iki aydır ilk büyük dalgalanmayı yaşadı. Küresel öncü modellerin ortalama fiyatı haftalık bazda %6,8, aylık bazda %11,3 arttı. ABD ve Avrupa nispeten istikrarlı kaldı (haftalık bazda -0,5%), ancak aylık bazda %4,1 yükseldi.
Citigroup, artan altyapının sırayla hayata geçirilmesiyle fiyat baskısının nihayetinde hafifleyeceğini belirtiyor. Bu noktada, değerli veriler ve görev özel performans, hesaplama gücü elde etmeye göre daha kalıcı bir koruma duvarı oluşturacaktır.
03 Agent Şablondan Kaçış
Modeller güçleniyor. Ancak modeller üzerinde çalışan ajanlar da daha tehlikeli hale geliyor.
Citibank raporu, kendi kendine çalışan AI ajanlarının sandbox'tan kaçışının gerçek riskini, Nisan'da "öğle yemeğini bozmak" düzeyinden Temmuz'da "Hugging Face altyapısına nüfuz etmek" düzeyine yükseltti.
Open source modeller ne kadar güçlü ve yaygın olursa, güvenlik risklerinin yayılma alanı o kadar genişler. AI düzenlemesi tartışmaları hâlâ devam ediyor—NVIDIA (24 Temmuz) ve ABD Maliye Bakanı Bessent (22 Temmuz) yakın zamanda açıklamalarda bulundu—ancak kısa vadede net bir sonuç beklenmiyor. Düzenleme çerçevesi hâlâ uygulamaya geçmemiş olsa bile, kendi modellerinin çalışma mimarisini koruyan şirketler daha yüksek uyumluluk eşikleriyle karşı karşıya kalıyor.
Daha da zor olan, bu modelleri eğiten sağlayıcıların dahi modellerin neden böyle davrandığını tam olarak inceleyememesidir. Açıklanabilirlik sorunu hâlâ çözülmemiştir.
Ancak güvenlik endişeleri, ajantların ticarileşmesini yavaşlatmadı. METR (21 Temmuz) verilerine göre, AI ajantlar ile insanlar arasındaki ekonomik fark daralmaktadır. Ajantlar daha bağımsız hale gelip ekonomik olarak uygulanabilirliğe daha yakınlaştıkça, token tüketimi hızla artacaktır—bu da tersine altyapı talebini artırır.
Daha güçlü yetenek, daha sıkı kısıtlamalar anlamına gelir. Daha sıkı kısıtlamalar, daha büyük altyapı ihtiyaçları getirir. Bu döngü, yavaşlama işareti göstermiyor.
