Ang totoong pagsubok sa isang autonomous agent ay hindi kung gaano karaming aksyon ang kayang makumpleto. Ito ay kung ano ang mangyayari kapag nagkakaroon ng pagkabigo. Sinabi ni @TheARCTERMINAL na isinagawa niya ang limang autonomous agent sa Ethereum sa 27 uri ng aksyon, na may onchain settlement at walang central controller. Ang 27 na aksyon ay interesante. Ang path ng pagkabigo ay mas interesante. Nakikita ba ng agent ang pagkabigo? Nagre-retry ba ito nang ligtas? Makakapigil ba ito bago magkaron ng cascading effect ang isang masamang hakbang? Makakapagpatuloy ba ang ibang agent nang hindi magdudulot ng error? Naging malinaw ba ang record ng pagkabigo pagkatapos? Ang autonomy ay tila nakakaimprenta kapag lahat ay gumagana. Ang reliability ay lumalabas kapag hindi. Dahil dito, mas gusto kong makita ang agent benchmarks na kasama ang recovery quality, hindi lang ang successful execution. Ang AI agents ay lumilipat mula sa chat interfaces patungo sa mga sistema na nagbabago ng external state. Sa punto na iyon, ang graceful failure ay naging isang capability. Kung ikaw ang mag-evaluate ng isang autonomous agent, mas mahalaga ba sa iyo ang success rate o recovery behavior?
riRoyal.Base.ethI-share

Source:Ipakita ang original
Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito.
Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.