May nakatagong problema ang mga pagtataya ng agent: Ang hurado mismo ay maaaring hindi maaasahan. Isang bagong eksperimento ay sinubukan ang Jev laban sa GPT-5.6 Luna, Terra, at Claude Sonnet 4.6. Ang mga resulta: → 500/500 na binary na desisyon ay tumugma sa human oracle → 92–913× mas mababang variance sa score → 0.44s na average latency → $0.00035 bawat pagtataya Hindi gumagawa ang Jev ng isang parirala at pagkatapos ay isasalin ito sa score. Direktang gumagawa ito ng structured na desisyon. Maaaring magbago ang ekonomiks ng pagtataya ng agent. Mas mura at mas mabilis na mga hurado ay nangangahulugan na mas maraming trace ang maaaring mataya ng mga team, mas maraming regression checks ang maaaring isagawa, at mas mapapalapit ang feedback loop sa bawat pag-update ng agent. Ang mahalagang babala: ito ay isang maliit na maagang eksperimento. Ngunit ang direksyon ay nakakatuwa: Maaaring kailanganin ng mga maaasahang agent na mas magandang mga hurado, hindi lamang mas magagandang models.
Dami-DefiI-share
Source:Ipakita ang original
Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito.
Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.