ABD hükümeti, Çin'in en yeni yapay zeka modelini bir siber saldırı testine tabi tuttu. Moonshot AI'nin Kimi K3'ün, en iyi Amerikan modellerinin çok altında kaldığını tespit etti.
ABD merkezli Yapay Zeka Standartları ve İnovasyon Merkezi (CAISI), testleri bir İngiliz ortakla gerçekleştirdi. Sonuçlar, Washington'un Moonshot'u, ABD teknolojisi çalıp Kimi K3 geliştirdiği iddiasını sunduktan bir gün sonra geldi.
Kimi K3, ABD Siber Göstergelerinde Yetersiz Kalıyor
Ticaret Bakanlığı, perşembe günü sonuçları paylaştı. Kimi K3'ün, İngiliz uzmanlarla yapılan ortak test'e dayanarak, en iyi ABD modellerinin çok altında yer aldığını belirtti.
Moonshot, 16 Temmuz'da Kimi K3'ü piyasaya sürdü. Talep o kadar yüksek oldu ki iki gün içinde yeni kayıtları durdurmak zorunda kaldı.
Açılış, Amerikan çip hisselerini sarstı ve Amerika'nın AI öncülüğüne dair yeni şüpheleri artırdı.
ExploitBench adlı bir test, Carnegie Mellon Üniversitesi tarafından oluşturulan gerçek Chrome tarayıcı hatalarını kullanır. Kimi K3, %32 puan aldı. Bu, Çin’in GLM-5.2’sini %24 ile geçti. Ancak yaklaşık %76 puan alan en üst ABD modellerinin gerisinde kaldı.

En zor adım, bir hedef makinesine tam kontrolü ele geçirmektir. Kimi K3, tüm 41 testte bu adımı başaramadı. En iyi ABD modelleri bunu 20 defa başardı.
The Last Ones adlı başka bir test, 32 adımdan oluşan sahte bir şirket ağı saldırısıdır. Bir insan uzmanının bunu tamamlaması yaklaşık 20 saat sürer. Kimi K3, ortalama olarak 17. adıma ulaşmıştır. En iyi ABD modelleri 28,5. adıma ulaşmıştır. Kimi K3, 10 denemede sadece bir kez tamamını tamamlamıştır.
En iyi ABD sistemlerinin bunu altı veya yedi kez yaptığı bildirildi.
Ancak boşluk, gerçek olduğundan daha büyük görünüyor olabilir
Ancak sayılar tüm hikayeyi anlatmaz. Raporun kendi küçük yazısı birkaç sakınca içeriyor.
Öncelikle ABD modelleri, güvenlik filtreleri kapatılarak test edildi. Bu ayar, modellerin tam gücünü gösterir. Kamu sürümleri bu filtreleri açık bırakır. Bu nedenle ABD puanları gerçek yaşam değil, en iyi senaryodur.
Takım, çalışmayı erken ve sınırlı olarak tamamladı. Kimi K3'ü sadece bir testte değerlendirdi ve tüm test setinin yalnızca bir kısmını çalıştırdı. Bu nedenle puanı kararsızdır. Bazı testler özel olduğundan, dışarıdaki kişiler çalışmayı kontrol edemiyor.
Ayrıca temel bir uyumsuzluk da var. Kimi K3, herkesin indirebileceği bir açık modeldir. ABD modelleri kilitli, özel sistemlerdir. İngiliz kurumu buldu ki açık modeller genellikle en iyi kapalı modellerden dört ila yedi ay geridedir. Kimi K3'e tam testi, Moonshot bunu halka açtıktan sonra verecektir.
Bu testler gerçek saldırılar da değildir. Sahte ağda hiçbir insan savunucu yoktu ve tetiklenecek hiçbir alarm yoktu. Yine de Kimi K3, son üst düzey açık modeli yendi. Ve bir kez tam saldırıyı tamamladı.
Zamanlama ve kaynak ayrıca sorular doğuruyor. CAISI, eski olarak ABD Yapay Zeka Güvenlik Enstitüsü idi. Trump yönetimi adını Haziran 2025'te değiştirdi. Çin'e çip satışlarını sınırlayan aynı bakanlıkta yer alıyor. Ve Çinli bir rakip hakkında raporu, çalınma iddiasından bir gün sonra geldi.
Zayıf Güvenlik Önlemleri Hâlâ Riskleri Yükseltiyor
Yine de düşük puanlar, Kimi K3'ün güvenli olduğunu anlamına gelmez. Test, koruma önlemlerinin onu hileler oluşturmak veya sistemlere saldırmakten engelleyemediğini ortaya koydu.
Bunun nedeni, sıradaki şeydir. Moonshot, tam modeli 27 Temmuz'da yayınlamayı planlıyor. Bir kez yayınlandığında, geri çekilemez. Herkes bunu indirip güvenlik filtrelerini kaldırabilir.
Test, bir hırsızlık iddiasının ardından da geldi. Washington, Moonshot'un Kimi K3'ü çalınmış ABD AI teknolojisi üzerinde inşa ettiğini söylüyor. Beyaz Saray teknoloji şefi Michael Kratsios, şirketin Anthropic'in Claude Fable 5'ini gizlice kopyaladığını söyledi. Distilasyon adı verilen bu yöntem, daha güçlü bir modelin cevapları üzerinde yeni bir modeli eğitir.
Anthropic, iddiayı destekliyor. Şubat ayında, izledi Moonshot üzerinden yüzlerce sahte hesapla 3,4 milyondan fazla Claude sohbetini. Kopyalanmış modellerin orijinalin güvenlik kontrollerini kaybettiğini uyardı. Bu, bu testin tam olarak bulduğu zayıf nokta.
ABD hâlâ Çin'den 23 kat daha fazla yapay zekaya harcıyor. Ancak Çinli laboratuvarlar bu farkı sürekli kapatmaya devam ediyor. Gerçek test, Kimi K3 halka açıldığında ve dış uzmanların iddiaları kendi kendilerine kontrol edebilmesiyle başlıyor.
