source avatarDr.R

I-share

Ngayon, inilabas ng Anthropic ang kanilang pinakabagong Claude Fable 5.1 / Mythos 5.1 (parehong modelo, iba’t ibang antas ng safety guardrails), isang katamtamang update sa gitna ng panahon na may kaunting pagpapabuti sa performance, ngunit para sa amin, mas mahalaga ang pagpapabuti sa stability at pagbaba ng presyo. Narito ang opisyal na update: 1. Pinakamalaking pagpapabuti sa agentic na kakayahan para sa pananaliksik Ang Terminal-Bench-Science ay tumalon mula sa 24.7% ng Fable 5 patungo sa 52.6% ng Mythos 5.1—halos nagdobleng pagtaas, at mas mataas pa kaysa sa 29.0% ng Opus 5. 2. Coding at mahabang gawain na walang pagmamasid Ang Terminal-Bench 4.0 ay umahon mula sa 42.0% patungo sa 55.8% (60.9% para sa Mythos 5.1), habang ang CursorBench 3.2.0 ay nakamit ang 73.4%. Gamit ang Millennium, nakahanap ito ng isang crash na may 1 sa isang milyong posibilidad na hindi nakita ng team sa loob ng apat hanggang limang taon at nauubos ng iba pang mga modelo. 3. Bumaba ang presyo ng humigit-kumulang 25% Ang cache read ay bumaba ng 75%, naging $0.25/milyong token; ang kabuuang gastos para sa karaniwang load ay bumaba ng humigit-kumulang 25%, at hanggang 45% para sa mga intensive agentic na scenario. Ang input ay nananatili sa $10, at ang output ay $50/milyong token. 4. Sapat na ang low-effort Kapag naka-set sa Low/Medium, ang performance ay nasa antas o higit pa sa Fable 5, ngunit mas mura—maaaring direkta na i-downgrade para sa mga scenario na sensitibo sa gastos. 5. Malaki ang pagbaba sa false positives sa safety guardrails Ang pagtigil sa mga网络安全 guardrails sa Claude Code ay bumaba ng humigit-kumulang 60%. Ngayon, pinapayagan na gamitin ito para sa vulnerability identification (hindi pa rin pinapayagan ang paggawa ng exploit, penetration testing, o binary scanning—ito ay ipapasa sa Opus). Ang false triggers para sa mga benign na tanong sa biyolohiya (pangunahing biyolohiya, medical queries) ay bumaba ng 85%. 6. Solusyon para sa pag-iingat ng enterprise data Ang bagong Enterprise Frontier Safeguards (EFS) ay nag-iimbak ng data sa sariling cloud ng customer, hindi sa Anthropic—katumbas ng zero data retention—at magkakaroon ito ng phased rollout noong tagtuyot; bago ito, ang mga customer na kumpleto ang mga kwalipikasyon ay maaari nang gumamit nang zero retention. 7. Mas magandang alignment kaysa sa nakaraang bersyon Mas kaunting paglabas sa testing environment para makakuha ng resources, mas kaunting paggamit ng "ito ay simulation/evaluation" bilang motivasyonal na paliwanag para magpaliwanag, mas mababa ang pagkakataon at tagumpay sa reward hacking, at ito ang pinakamatibay na modelo laban sa prompt injection. Dalawang karagdagang puntos na dapat malaman: Hindi na maaaring manu-manong i-edit ang historical thinking content ni Claude sa loob ng multi-turn dialogues para sa bagong API accounts (upang maiwasan ang distillation), at ang output ay may invisible text watermark ayon sa EU AI Act—hindi nakakaapekto sa kalidad ng nilalaman at walang anumang impormasyon ng user.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.