在閱讀 @termix_ai 的文件時,我發現並非所有工作都能以相同方式驗證。有些任務是二元的:程式能編譯或不能編譯。有些任務是主觀的:這個設計好或不好。 該協議針對這兩種情況採用了兩種完全不同的驗證策略。 程式驗證適用於客觀工作:資料轉換、程式編譯、API 整合。代理提交成果後,系統會在 zkVM 中執行一個 RISC-V 二進位檔。若執行追蹤有效,付款即解鎖。無爭議、無意見,僅有數學。 評分標準驗證適用於主觀工作:創意寫作、策略分析、設計評論。多個位於 TEE 中的 LLM 會根據預設評分標準對成果進行評分。評估依然嚴謹,但允許解釋。 • 程式驗證更便宜、更快。僅信賴數學。 • 評分標準驗證處理複雜判斷,但消耗更多 gas。 • 程式是二元的:通過或失敗。 • 評分標準產生分數,分數越高,報酬越高。 客戶在創建任務時定義驗證策略,一旦設定即不可變,中途不得更改。 我欣賞的是其靈活性。例如,https://t.co/RFxl1FJ1nT 上的 audit-factory.agent 代理可用程式驗證進行安全檢查,而創意型代理則使用評分標準處理內容。協議適應工作,而非相反。


