Claude Fable 5.1, Robotik Görev Performansını 8 Kat Artırıyor

iconCryptoBriefing
Paylaş
AI summary iconÖzet
Anthropic'ın 1 Eylül 2026 tarihinde piyasaya sunduğu Claude Fable 5.1, robotik seç ve yerleştir performansını 8 kat artırarak başarı oranlarını %5'ten %40'a çıkardı. Zincir üzerindeki veriler, Terminal-Bench-Science ve OSWorld 2.0 gibi uzun vadeli görevlerde güçlü artışları gösteriyor. Kurumsal kullanıcılar, karmaşık iş akışlarında daha iyi güvenilirlik ve %45 maliyet tasarrufu rapor ediyor. Önbellek okuma maliyetleri %75 düştü, fiyat değişikliği olmadan. Korku ve açgözlülük endeksi trendleri, AI tabanlı otomasyon araçlarına olan ilginin arttığını gösteriyor.

Robotik kollar, şeyleri tutmada kötü olduğunu kanıtlanmış bir geçmişe sahiptir. Anthropic’in 1 Eylül 2026 tarihinde piyasaya sürdüğü Claude Fable 5.1, bu soruna önemli bir darbe indirdi.

Model, robotik seç ve yerleştir görevlerinde %40 başarı oranı sağlıyor, önceki nesil Claude Fable 5'in %5'inden daha yüksek.

İçerde ne değişti

Fable 5.1, insanın elini tutmadan birçok adımda planlama, yürütme ve kurtarma gerektiren uzun vadeli ajanlık görevleri için tasarlanmıştır. Kodlama hatları, bilimsel araştırma iş akışları ve karmaşık iş otomasyonları hedef alanlardır.

Referans sayılar bu odaklanmayı yansıtmaktadır. Terminal-Bench-Science üzerinde Fable 5.1, 24,7% olan Fable 5'e kıyasla %52,6 puan almıştır. OSWorld 2.0 katı tamamlama oranı 36,1%'den 41,7%'ye çıkmıştır. Çok adımlı yazılım otomasyonunu test eden AutomationBench, 17,1%'den 31,4%'ye yükselmiştir.

Reklam

Yayın sonrası müşteri geri bildirimleri, referans hikayesini yansıttı. Kurumsal kullanıcılar, modelin önceki sürümlerden daha az token kullanarak saatler süren projelerde daha iyi bir güvenilirlik sağladığını özellikle belirtti.

Fiyatlandırma matematiği göründüğünden daha ilginç

Fable 5.1 için temel fiyatlandırma, önceki modeldeki gibi milyon girdi token başına 10 dolar ve milyon çıktı token başına 50 dolar olarak sabit kalıyor.

Önbellek okuma maliyeti, milyon token başına $0,25'e düşerek %75 azaldı. Anthropic, önbellek azalmasının tipik iş yüklerinde yaklaşık %25 tasarruf sağladığını tahmin ediyor. Daha karmaşık ajan sistemleri için tasarruf %45'e ulaşabilir.

Model, Pro, Max, Takım ve Kurumsal kullanıcılar için mevcuttur ve API ile büyük bulut pazar yerlerinden erişilebilir.

Robotika sayısı neden kendi konuşmasını hak ediyor

Seç ve yerleştir iyileştirmesi ana rakamdır, ancak bu belirli performans ölçütünün neden önemli olduğu konusunda durmak değerlidir. Seç ve yerleştir, fiziksel dünyaya dayanma için bir göstergedir: bir yapay zeka modeli soyut akıl yürütme ile hassas, gerçek dünya motor komutlarına dönüşüm yapabilir mi? Görev, nesne tanıma, mekânsal akıl yürütme, kavrama planlama ve şeyler yanlış gittiğinde hata düzeltmeyi içerir.

%5 başarı oranı temelde gürültüdür. %40 oran, makine öğrenimi ile endüstriyel kullanım için henüz yeterli değildir, ancak bu oran, teknolojinin bir ilgi çekici özellikten ziyade insan destekli bir katman olarak kullanılmaya başlanabilecek eşiği aşar.

Rekabetçi bağlam

Bağımsız değerlendiriciler, Claude Fable 5.1'in yayınlandıktan kısa bir süre sonra akıl indekslerinde önceki liderlerle eşit veya daha yüksek puanlar aldığını sıraladı. Terminal-Bench-Science, OSWorld 2.0 ve AutomationBench üzerindeki iyileştirmelerin deseni, Anthropic'ın hızlı sorular soran tüketicilerden ziyade karmaşık, çok adımlı, çok saatlik iş akışları çalıştıran kurumsal müşterileri hedef aldığını göstermektedir.

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.