source avatarDami-Defi

Поділитися

Оцінки агентів мають приховану проблему: Сам суддя може бути ненадійним. Новий експеримент порівняв Jev з GPT-5.6 Luna, Terra та Claude Sonnet 4.6. Результати: → 500/500 бінарних рішень збіглися з людським оракулом → розсіювання оцінок у 92–913 разів нижче → середня затримка 0,44 с → $0,00035 за оцінку Jev не генерує абзац, а потім перетворює його на оцінку. Він приймає структуроване рішення безпосередньо. Це може змінити економіку оцінки агентів. Дешевші та швидші судді дозволяють командам оцінювати більше трас, запускати більше регресійних перевірок і скорочувати цикл зворотного зв’язку після кожного оновлення агента. Важлива оговорка: це був вузький початковий експеримент. Але напрямок захоплюючий: Надійні агенти можуть вимагати кращих суддів, а не лише кращих моделей.

Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації. Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.