騰訊已推出 Hy4 預覽版,這是一個開源的專家混合(MoE)模型。此發布標誌著中國日趨激烈的 AI 军備競賽進一步升級,該國最大的科技公司正競相打造規模越來越大的基礎模型。
以背景而言,騰訊先前的 Hy3 模型總參數量為 295 億。可以將參數視為模型在訓練期間可調節的旋鈕和控制鍵:更多的參數通常意味著模型能學習更細膩的模式,但這些參數的使用效率同樣至關重要。
從 Hy3 到 Hy4:快速演進
Hy4 預覽版建立在原本堅實的基礎之上。騰訊的 Hy3 模型是一款總參數為 295B 的 MoE 架構,其中激活參數為 21B,上下文窗口為 256K,於 2026 年 4 月在 Apache 2.0 許可下開源,並於 7 月正式發布。
Hy3 從預覽版轉為正式發佈後,週使用量增長超過 68 倍。
Hy3 成為騰訊一系列不斷擴展產品的背後引擎,為元寶(騰訊的 AI 助理應用)、CodeBuddy(其程式碼助理)和 WorkBuddy(其企業生產力工具)等功能提供支援。該模型在推理、程式碼編寫和處理複雜多步驟任務方面帶來了顯著的改進。
灰度測試與全面上線之路
在 2026 年 8 月 12-13 日左右的第二季財報中,騰訊披露將立即推出參數量更大的 Hy4 模型,重點提升效能與多模態能力。
截至8月20日至21日,Tencent Yuanbao 應用程式中出現了 Hy4 模型的初步灰度測試,其被定位為「專家級模型」。尚未公布任何官方規格,包括確切的參數數量和架構細節。
Hy 系列由騰訊首席 AI 科學家姚舜宇領導。騰訊採用雙重策略:一方面開發如 Hy 系列的自有模型,另一方面同時利用頂級開源替代方案,包括 DeepSeek 的模型。
