Robotik kollar, şeyleri tutmada kötü olduğunu kanıtlanmış bir geçmişe sahiptir. Anthropic’in 1 Eylül 2026 tarihinde piyasaya sürdüğü Claude Fable 5.1, bu soruna önemli bir darbe indirdi.
Model, robotik seç ve yerleştir görevlerinde %40 başarı oranı sağlıyor, önceki nesil Claude Fable 5'in %5'inden daha yüksek.
İçerde ne değişti
Fable 5.1, insanın elini tutmadan birçok adımda planlama, yürütme ve kurtarma gerektiren uzun vadeli ajanlık görevleri için tasarlanmıştır. Kodlama hatları, bilimsel araştırma iş akışları ve karmaşık iş otomasyonları hedef alanlardır.
Referans sayılar bu odaklanmayı yansıtmaktadır. Terminal-Bench-Science üzerinde Fable 5.1, 24,7% olan Fable 5'e kıyasla %52,6 puan almıştır. OSWorld 2.0 katı tamamlama oranı 36,1%'den 41,7%'ye çıkmıştır. Çok adımlı yazılım otomasyonunu test eden AutomationBench, 17,1%'den 31,4%'ye yükselmiştir.
Yayın sonrası müşteri geri bildirimleri, referans hikayesini yansıttı. Kurumsal kullanıcılar, modelin önceki sürümlerden daha az token kullanarak saatler süren projelerde daha iyi bir güvenilirlik sağladığını özellikle belirtti.
Fiyatlandırma matematiği göründüğünden daha ilginç
Fable 5.1 için temel fiyatlandırma, önceki modeldeki gibi milyon girdi token başına 10 dolar ve milyon çıktı token başına 50 dolar olarak sabit kalıyor.
Önbellek okuma maliyeti, milyon token başına $0,25'e düşerek %75 azaldı. Anthropic, önbellek azalmasının tipik iş yüklerinde yaklaşık %25 tasarruf sağladığını tahmin ediyor. Daha karmaşık ajan sistemleri için tasarruf %45'e ulaşabilir.
Model, Pro, Max, Takım ve Kurumsal kullanıcılar için mevcuttur ve API ile büyük bulut pazar yerlerinden erişilebilir.
Robotika sayısı neden kendi konuşmasını hak ediyor
Seç ve yerleştir iyileştirmesi ana rakamdır, ancak bu belirli performans ölçütünün neden önemli olduğu konusunda durmak değerlidir. Seç ve yerleştir, fiziksel dünyaya dayanma için bir göstergedir: bir yapay zeka modeli soyut akıl yürütme ile hassas, gerçek dünya motor komutlarına dönüşüm yapabilir mi? Görev, nesne tanıma, mekânsal akıl yürütme, kavrama planlama ve şeyler yanlış gittiğinde hata düzeltmeyi içerir.
%5 başarı oranı temelde gürültüdür. %40 oran, makine öğrenimi ile endüstriyel kullanım için henüz yeterli değildir, ancak bu oran, teknolojinin bir ilgi çekici özellikten ziyade insan destekli bir katman olarak kullanılmaya başlanabilecek eşiği aşar.
Rekabetçi bağlam
Bağımsız değerlendiriciler, Claude Fable 5.1'in yayınlandıktan kısa bir süre sonra akıl indekslerinde önceki liderlerle eşit veya daha yüksek puanlar aldığını sıraladı. Terminal-Bench-Science, OSWorld 2.0 ve AutomationBench üzerindeki iyileştirmelerin deseni, Anthropic'ın hızlı sorular soran tüketicilerden ziyade karmaşık, çok adımlı, çok saatlik iş akışları çalıştıran kurumsal müşterileri hedef aldığını göstermektedir.
