Lengan robot memiliki sejarah terdokumentasi dengan buruk dalam mengambil benda-benda. Claude Fable 5.1 dari Anthropic, yang dirilis pada 1 September 2026, baru saja membuat kemajuan signifikan dalam memecahkan masalah tersebut.
Model ini mencapai tingkat keberhasilan 40% pada tugas pengambilan dan penempatan robotik, naik dari 5% untuk pendahulunya Claude Fable 5.
Apa yang berubah di balik layar
Fable 5.1 dirancang untuk pekerjaan agen jangka panjang, kategori tugas di mana model perlu merencanakan, mengeksekusi, dan pulih melalui banyak langkah tanpa bantuan manusia. Pipeline pemrograman, alur kerja penelitian ilmiah, dan otomatisasi bisnis kompleks adalah target utamanya.
Angka-angka patokan mencerminkan fokus tersebut. Pada Terminal-Bench-Science, Fable 5.1 mendapat skor 52,6%, dibandingkan 24,7% untuk Fable 5. OSWorld 2.0 strict completion naik dari 36,1% menjadi 41,7%. AutomationBench, yang menguji otomatisasi perangkat lunak multi-langkah, naik dari 17,1% menjadi 31,4%.
Umpan balik pelanggan setelah peluncuran mengikuti cerita patokan. Pengguna perusahaan secara khusus menyebut peningkatan keandalan pada proyek yang berjalan selama jam, bukan menit, dengan model yang menyelesaikan tugas-tugas tersebut menggunakan lebih sedikit token dibandingkan versi sebelumnya.
Matematika penetapan harga lebih menarik daripada yang terlihat
Harga dasar untuk Fable 5.1 tetap stabil di $10 per juta token masukan dan $50 per juta token keluaran, sama seperti model sebelumnya.
Biaya pembacaan cache turun 75% menjadi $0,25 per juta token. Anthropic memperkirakan pengurangan cache ini setara dengan penghematan sekitar 25% pada beban kerja umum. Untuk pipeline agen yang lebih kompleks, penghematan dapat mencapai 45%.
Model ini tersedia untuk pengguna Pro, Max, Tim, dan Enterprise, dan dapat diakses melalui API dan pasar cloud utama.
Mengapa angka robotika layak mendapatkan percakapan tersendiri
Peningkatan pick-and-place adalah angka utama, tetapi penting untuk memahami mengapa tolok ukur spesifik ini penting. Pick-and-place adalah proxy untuk dasar dunia nyata: dapatkah model AI menerjemahkan penalaran abstrak menjadi perintah motorik yang tepat dan nyata? Tugas ini melibatkan pengenalan objek, penalaran spasial, perencanaan pegangan, dan pemulihan kesalahan saat terjadi masalah.
Tingkat keberhasilan 5% pada dasarnya adalah kebisingan. Tingkat 40% belum cukup baik untuk penerapan industri tanpa pengawasan, tetapi telah melewati ambang di mana teknologi ini menjadi berguna sebagai lapisan bantuan manusia, bukan sekadar kuriositas.
Konteks kompetitif
Evaluators independen memberi peringkat Claude Fable 5.1 setara atau lebih tinggi daripada pemimpin sebelumnya pada indikator kecerdasan tak lama setelah rilisnya. Pola peningkatan di Terminal-Bench-Science, OSWorld 2.0, dan AutomationBench menunjukkan bahwa Anthropic sedang menargetkan pelanggan perusahaan yang menjalankan alur kerja kompleks, multi-langkah, dan berdurasi berjam-jam, bukan konsumen yang mengajukan pertanyaan cepat.
