Ang mga robotic arm ay may maayos na dokumentadong kasaysayan ng pagiging nakakapagod sa paghuhulog ng mga bagay. Ang Anthropic’s Claude Fable 5.1, na ipinakilala noong Setyembre 1, 2026, ay nagbigay ng malaking pagbabago sa problema na iyon.
Ang modelo ay nakakamit ng 40% na rate ng tagumpay sa mga gawain sa robotic pick-and-place, tumaas mula sa 5% para sa kanyang naunang bersyon na Claude Fable 5.
Ano ang nagbago sa ilalim ng kahon
Ang Fable 5.1 ay disenyo para sa mga gawain na may mahabang panahon na agente, ang kategorya ng mga gawain kung saan kailangan ng modelo na magplano, magpapatupad, at mabawi sa maraming hakbang nang walang tulong ng tao. Ang mga coding pipeline, scientific research workflows, at kompleks na business automation ay ang target na larangan.
Ang mga benchmark numbers ay nagpapakita ng pagkakasentro. Sa Terminal-Bench-Science, ang Fable 5.1 ay nakakuha ng 52.6%, kumpara sa 24.7% para sa Fable 5. Ang OSWorld 2.0 strict completion ay tumataas mula sa 36.1% patungo sa 41.7%. Ang AutomationBench, na nagtetest ng multi-step software automation, ay tumataas mula sa 17.1% patungo sa 31.4%.
Ang feedback ng mga customer pagkatapos ng paglunsad ay sumasalamin sa kuwento ng benchmark. Ang mga enterprise user ay partikular na binanggit ang pinabuting kumpiyansa sa mga proyekto na tumatagal ng oras, hindi minuto, kung saan natatapos ng model ang mga gawain gamit ang mas kaunting mga token kaysa sa mga nakaraang bersyon.
Mas interesante ang pagkalkula ng presyo kaysa sa tila
Ang base pricing para sa Fable 5.1 ay nananatiling $10 bawat milyong input tokens at $50 bawat milyong output tokens, pareho na ang nakaraang modelo.
Bumaba ang gastos sa cache-read ng 75% hanggang $0.25 bawat milyong token. Ikinakalkula ni Anthropic na ang pagbawas sa cache ay nagtataglay ng halos 25% na savings sa karaniwang workload. Para sa mas kumplikadong agentic pipelines, ang savings ay maaaring umabot sa 45%.
Available sa mga Pro, Max, Team, at Enterprise user, at ma-access sa pamamagitan ng API at mga pangunahing cloud marketplace.
Bakit meritong sariling usapan ang bilang ng robotics
Ang pagpapabuti ng pick-and-place ang pangunahing numero, ngunit mahalaga na unawain kung bakit mahalaga ang partikular na benchmark na ito. Ang pick-and-place ay isang proxy para sa physical-world grounding: makakapag-translate ba ang isang AI model ng abstraktong pag-iisip sa mga tiyak, real-world na motor command? Ang gawain ay nagsasangkot ng object recognition, spatial reasoning, grasp planning, at error recovery kapag nagkakaroon ng mga problema.
Ang isang 5% na rate ng tagumpay ay kahalintulad ng ingay. Ang isang 40% na rate ay hindi pa sapat para sa walang pagmamano-manong paggamit sa industriya, ngunit lumilipas ang tuldok kung saan ang teknolohiya ay naging kapaki-pakinabang bilang isang tulong para sa tao kaysa isang kuriosidad.
Kumpetitibong konteksto
Ang mga independiyenteng evaluator ay nagbigay ng rating na 5.1 kay Claude Fable o mas mataas kaysa sa mga dating lider sa mga index ng intelihensya agad pagkatapos ng paglabas. Ang pattern ng pagpapabuti sa Terminal-Bench-Science, OSWorld 2.0, at AutomationBench ay nagpapakita na tinutukoy ni Anthropic ang mga enterprise customer na nagpapatakbo ng mga kumplikadong, multi-step, multi-hour na workflow kaysa sa mga consumer na nagtatanong ng mabilis na tanong.
