Sakana AIが、実世界のセキュリティベンチマークでGPT-5.5-CyberおよびMythos Previewを上回りました。 > CyberGymで86.9、CTI-REALMで72.1 — 両方のリーダーボードで1位 > 単一モデルではなくオーケストレーションモデル — Fuguがタスクをルーティングし調整します OpenAIやAnthropicの最先端のサイバーモデルを凌駕する小さなラボ。
0xMarioNawfalSakana AIが、実世界のセキュリティベンチマークでGPT-5.5-CyberおよびMythos Previewを上回りました。 > CyberGymで86.9、CTI-REALMで72.1 — 両方のリーダーボードで1位 > 単一モデルではなくオーケストレーションモデル — Fuguがタスクをルーティングし調整します OpenAIやAnthropicの最先端のサイバーモデルを凌駕する小さなラボ。
