Mas mataas ang antas ng katalinuhan ng Opus 5 kaysa sa Fable 5, at bawasan ang gastos sa gawain ng 26%

iconChainthink
I-share
AI summary iconSummary
Noong Hulyo 25, ipinakita ng third-party evaluation firm na Artificial Analysis na ang Opus 5 ay naging mas mataas kaysa sa Fable 5 sa isang nine-item intelligence test, na nakakuha ng 61 kumpara sa 60 ng Fable 5. Ang fear and greed index ay nananatiling kalmado habang ang Opus 5 ay bawas ang average task cost sa $2.03, isang 26% na pagpapabuti. Ito ang nangunguna sa GDPval-AA v2 at AA-Briefcase evaluations at nagkaroon ng pagkakapareho sa unang puwesto sa programming Agent index kasama ang Claude Code. Nananatiling nasa likod ang Opus 5 sa factual accuracy, na may 50% hallucination rate sa AA-Omniscience. Ang mga trader ay nagmamasid sa mga altcoin na dapat bisitahin dahil ang mababang reasoning cost-effectiveness ng Opus 5 ay nananatiling kaunting nasa likod ng GPT-5.6.

mensahe ni ChainThink, noong Hulyo 25, ayon sa third-party evaluation firm na Artificial Analysis, ang Claude Opus 5 ay nakakuha ng 61 puntos sa comprehensive intelligence index na binubuo ng 9 mga pagsusulit, na may maliit na pagkakalaban sa 60 puntos ng Fable 5.

Ang GPT-5.6 Sol ay nakakuha ng 59 puntos, habang ang Kimi K3 ay nakakuha ng 57 puntos. Sa halagang pansaklaw, ang average na gastos ng Opus 5 ay $2.03 bawat gawain, na 26% mas mababa kaysa sa $2.75 ng Fable 5.

Nakakamit ng unang puwesto ang modelo sa mga pagsubok sa kaalaman na GDPval-AA v2 at AA-Briefcase, at nagkakaroon ng pangunahang puwesto sa Programming Agent Index kasama ang Claude Code;

Ang Terminal-Bench v2.1 ay may marka na 89%, na halos katumbas ng GPT-5.6 Sol. Ang Opus 5 ay nagtataglay ng 5 antas ng pag-iisip.

Mula sa low hanggang max, ang pagkakaiba ng Token ay humigit-kumulang 8 beses, at ang pagkakaiba ng GDPval-AA v2 ay 407 Elo; maaaring ayusin ng mga user ang pagitan ng performance at gastos.

Ang pagsusuri ay nagpapakita rin na ang katotohanang kaalaman ng Opus 5 ay nananatiling mas mababa kaysa sa Fable 5. Sa AA-Omniscience test, tumataas ang rate ng pagkakamali nito sa 50%, 14 na puntos ang higit sa Opus 4.8;

Ang halaga sa low reasoning tier ay patuloy na kaunti lang mas mababa kaysa sa GPT-5.6 series.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.