source avatarDr.R

Paylaş

Bugün Anthropic, Claude Fable 5.1 / Mythos 5.1 (aynı model, farklı güvenlik seviyeleri)’i yayınladı; orta ölçekli bir güncelleme, performans artışı sınırlı, ancak bizim için daha çok stabilite artışı ve fiyat düşüşü anlamına geliyor. Resmi güncelleme detayları şunlar: 1. Bilimsel agentic yeteneklerde en büyük artış Terminal-Bench-Science, Fable 5’in 24,7%’inden 52,6%’ye yükseldi, neredeyse iki katına çıktı ve Opus 5’in 29,0%’ini açıkça geride bıraktı. 2. Kodlama ve uzun süreli bekleme görevleri Terminal-Bench 4.0, 42,0%’den 55,8%’e (Mythos 5.1: 60,9%) yükseldi; CursorBench 3.2.0 ise 73,4%’e ulaştı. Millennium, bu modeli kullanarak ekiplerinin dört-beş yıldır tespit edemediği ve diğer modellerin kaçırduğu milyonda bir olasılıkla oluşan çöküşleri tanımladı. 3. Fiyat yaklaşık %25 düştü Önbellek okuma (cache read) fiyatı %75 indirildi ve $0,25/ milyon token oldu; tipik yüklerde toplam maliyet yaklaşık %25 azaldı, yoğun agentic senaryolarda en fazla %45’e kadar düştü. Girdi $10, çıktı $50 / milyon token olarak sabit kalıyor. 4. Düşük çaba ile de yeterli Low/Medium olarak ayarlandığında, Fable 5’e eşit veya daha iyi performans gösteriyor ancak maliyet çok daha düşük—maliyet duyarlı senaryolarda doğrudan daha düşük bir seviyeye geçilebilir. 5. Güvenlik duvarlarının yanlış tetiklenmesi büyük ölçüde azaldı Claude Code’da ağ güvenliği duvarlarının engelleme sayısı ortalama %60 azaldı ve artık bu modelle güvenlik açıkları tanımlamak için kullanılabilir (exploit yazma, penetrasyon testi veya ikili dosya taraması hâlâ yasak ve Opus’a yönlendirilir). Biyolojik konularda (temel biyoloji, tıbbi sorular) yanlış tetiklenme %85 azaldı. 6. Kurumsal veri kalıcılık çözümü Yeni Enterprise Frontier Safeguards (EFS), verileri Anthropic’de değil müşterinin kendi bulutunda saklar; bu, sıfır veri kalıcılık anlamına gelir ve sonbaharda aşamalı olarak piyasaya sürülecektir; bu süreye kadar uygun şartları sağlayan müşteriler doğrudan sıfır veri kalıcılık ile kullanabilir. 7. Önceki nesilden daha iyi uyum performansı Test ortamının dışına çıkarak kaynak alma eğilimi azaldı, “bu bir simülasyon/evalüasyon” gibi gerekçelerle kendini savunma eğilimi azaldı, reward hacking girişimleri ve başarı oranları daha düşük; ayrıca şu ana kadar prompt enjeksiyonuna karşı en kararlı model. Ek olarak iki nokta dikkat edilmelidir: Yeni API hesapları artık Claude’nin çoklu diyalog geçmişindeki düşüncelerini manuel olarak düzenleyemeyecek (distilasyona karşı); ayrıca çıktılar, EU AI Yasası gereği görünür olmayan bir metin su damlası ile birlikte verilecek; bu, içerik kalitesini etkilemez ve hiçbir kullanıcı bilgisi içermez.

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.