ME News 消息,7 月 29 日(UTC+8),月之暗面推出 Kimi Linear,一種混合線性注意力架構,首次在短上下文、長上下文和強化學習場景下全面超越全注意力機制。其 3B 激活參數模型在所有評估任務上顯著優於全 MLA,同時將 KV cache 使用量降低最多 75%,並在 1M 上下文下實現最高 6 倍解碼吞吐量。月之暗面已開源 KDA 核心、vLLM 實現及模型權重。 🔗 閱讀原文 via AI HOT · https://aihot.virxact.com/items/cms4t5zra01o1roa10b19hmbh(來源:AiHot)
Moonshot 推出 Kimi Linear,一種高性能注意力架構
KuCoinFlash分享
Moonshot 於 7 月 29 日(UTC+8)推出 Kimi Linear,這是一種高性能的注意力架構。該混合線性模型在短上下文、長上下文情境及強化學習中表現優於完整注意力。擁有 3B 個活動參數,它在 1M 上下文下將 KV 緩存使用量減少 75%,並提升解碼吞吐量 6 倍。KDA 核心、vLLM 實現與模型權重均已開源。評估支撐與阻力位的交易者可能發現此進展能改善演算法策略的風險報酬比。
來源:顯示原文
免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。
虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款和風險披露 。