Sakana AI 剛剛在實際安全基準測試中擊敗了 GPT-5.5-Cyber 和 Mythos Preview。 > 在 CyberGym 得分 86.9,CTI-REALM 得分 72.1 —— 兩項排行榜均位居榜首 > 這是一個協調模型,而非單一模型 —— Fugu 負責路由與協調工作 一家小型實驗室的表現超越了 OpenAI 和 Anthropic 的前沿網絡模型。
0xMarioNawfalSakana AI 剛剛在實際安全基準測試中擊敗了 GPT-5.5-Cyber 和 Mythos Preview。 > 在 CyberGym 得分 86.9,CTI-REALM 得分 72.1 —— 兩項排行榜均位居榜首 > 這是一個協調模型,而非單一模型 —— Fugu 負責路由與協調工作 一家小型實驗室的表現超越了 OpenAI 和 Anthropic 的前沿網絡模型。
