ロボットアームは、物をつかむのが非常に難しいというよく知られた歴史を持っている。2026年9月1日にリリースされたAnthropicのClaude Fable 5.1は、この問題に大きな進展をもたらした。
このモデルは、前世代のClaude Fable 5の5%から40%まで、ロボットによるピックアンドプレースタスクの成功率を向上させました。
内部で何が変わったのか
Fable 5.1は、長期間にわたるエージェント作業向けに設計されています。このカテゴリのタスクでは、モデルが人間の手を借りることなく、複数のステップにわたり計画を立て、実行し、回復する必要があります。コーディングパイプライン、科学的研究のワークフロー、複雑なビジネス自動化が対象です。
ベンチマーク数値はその集中力を反映しています。Terminal-Bench-Scienceでは、Fable 5.1は52.6%を記録し、Fable 5は24.7%です。OSWorld 2.0の厳格な完了率は36.1%から41.7%へ上昇しました。マルチステップのソフトウェア自動化をテストするAutomationBenchは、17.1%から31.4%へ上昇しました。
ローンチ後の顧客のフィードバックは、ベンチマークのストーリーと一致しました。エンタープライズユーザーは、数分ではなく数時間かかるプロジェクトで信頼性が向上したと特に挙げており、モデルが以前のバージョンよりも少ないトークンでこれらのタスクを完了したと述べています。
価格の計算は見た目以上に興味深い
Fable 5.1の基本料金は、前モデルと同じく、入力トークン100万に対して10ドル、出力トークン100万に対して50ドルです。
キャッシュ読み取りコストは100万トークンあたり0.25ドルに低下し、75%削減されました。Anthropicは、キャッシュ削減により通常のワークロードで約25%の貯蓄が実現されると推定しています。より複雑なエージェントパイプラインでは、貯蓄率は45%に達する可能性があります。
このモデルは、Pro、Max、Team、Enterpriseユーザーが利用可能で、APIおよび主要なクラウドマーケットプレイスからアクセスできます。
ロボティクス番号が独自の会話を持つべき理由
ピックアンドプレースの改善が目立つ数値だが、なぜこの特定のベンチマークが重要なのかを理解することが価値がある。ピックアンドプレースは、現実世界への接地能力の指標である:AIモデルは、抽象的な推論を正確な現実世界のモーター指令に変換できるか?このタスクには、物体認識、空間的推論、グリップ計画、そしてエラー発生時の回復が含まれる。
5%の成功率は本質的にノイズにすぎません。40%の成功率は、無監督の産業導入にはまだ十分ではありませんが、単なる興味対象ではなく、人間の補助レイヤーとして技術が有用になる境界線を超えています。
競合状況
独立した評価者たちは、Claude Fable 5.1のリリース直後に、知能指標において以前のリーダーと同等以上であると評価しました。Terminal-Bench-Science、OSWorld 2.0、AutomationBenchにおける改善のパターンは、Anthropicが迅速な質問をする消費者ではなく、複雑で複数ステップ、複数時間にわたるワークフローを実行する企業顧客をターゲットにしていることを示唆しています。
