source avatarriRoyal.Base.eth

Поділитися

Справжній тест автономного агента — не в тому, скільки дій він може виконати. А в тому, що відбувається, коли одна з них зазнає невдачі. @TheARCTERMINAL каже, що запустив п’ять автономних агентів на Ethereum, які виконували 27 типів дій із ончейн-розрахунками та без центрального контролера. 27 дій цікаві. Але шлях невдачі — цікавіший. Чи виявляє агент невдачу? Чи намагається він повторити дію безпечно? Чи може він зупинитися, перш ніж одна погана дія спричинить ланцюгову реакцію? Чи може інший агент продовжити роботу, не успадковуючи помилку? Чи робить запис невдачу очевидною після цього? Автономність виглядає вражливо, коли все працює. Надійність проявляється, коли ні. Ось чому я б хотів бачити, щоб у тестах агентів враховувалася якість відновлення, а не лише успішне виконання. AI-агенти переходять від чат-інтерфейсів до систем, що змінюють зовнішній стан. У цей момент граційна невдача стає здатністю. Якби ви оцінювали автономного агента, чим би ви цікавилися більше: показником успішності чи поведінкою при відновленні?

No.0 picture
Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації. Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.