Qwen3.8-Max 在漏洞召回率上與 Opus 5 相當,成本僅為其一半

iconChainthink
分享
AI summary icon精華摘要
Qwen3.8-Max 在漏洞新聞召回率上與 Opus 5 相當,但成本僅為其一半。Aikido 的測試發現,Qwen3.8-Max 在三輪測試中成功檢測出 32 個漏洞中的 26 個,召回率達 81.3%。Opus 5 的召回率相同,但成本為 $1,642。Qwen3.8-Max 的 F1 分數為 83.2%,低於 Kimi K3 Max 和 GPT-5.6 Sol。利率新聞對結果無影響。DeepSeek V4 Flash 仍是最便宜的選擇,成本為 $164。

ChainThink 消息,8 月 5 日,安全公司 Aikido 使用代碼審計 Agent 測試 7 款模型,涵蓋 Qwen3.8-Max、Claude Opus 5、Kimi K3 Max、DeepSeek V4 Flash、GPT-5.6 Sol、Luna 和 Terra。

測試包含 32 個近期公開漏洞,每款模型運行 3 次。Qwen3.8-Max 三輪合計找到 26 個漏洞,召回率為 81.3%,與 Claude Opus 5 並列第 1 名。

Qwen3.8-Max 的 F1 綜合分為 83.2%,略低於 Opus 5、Kimi K3 Max 和 GPT-5.6 Sol。

其單次表現穩定性較弱,26 個漏洞中僅有 10 個連續三輪均被找到,Opus 5 和 Sol 均為 19 個。

在成本方面,Qwen3.8-Max 的總成本約為 821 美元,約為 Opus 5 和 Sol 的一半,但仍是 DeepSeek V4 Flash 的 5 倍。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露