source avatar链研社|AI First🔶💧

分享

Google 和 腾訊 在模型上做了幾乎一模一樣的動作:小模型、效率、推理速度、低成本、嵌入生態,注重智能密度而非智能上限。 Google 這波發了三款,主角是 Gemini 3.6 Flash。騰訊那邊是 7 月 6 號正式發布的混元 Hy3。兩邊都沒去卷最貴的旗艦。Google 的 3.5 Pro 到現在還未公開,Bloomberg 說內部編碼基準沒達標。騰訊的 Hy3 是 295B 總參數、只激活 21B 的 MoE,每次推理只耗 7% 的算力。 這就很有意思了。 3.6 Flash 的輸出價格從 9 美元降到 7.5 美元,速度從 165 tokens/s 提升到 304 tokens/s,快了近一倍。智能指數仍是 50,但使用的 token 更少,同套評測賬單從 1 041 美元降至 727 美元,減少三成。Hy3 更狠,辦公 Agent 任務解決率從 72% 提升到 90%,做文檔省下 47.4% 的 token,做 PPT 省下 49.0%。 現在這兩家根本不想比誰模型更聰明。他們在搶一個更值錢的東西:默認入口。 智能足夠用就行,真正值錢的是把模型塞進用戶已經在用的產品裡。Google 有 Copilot、Workspace、Antigravity。騰訊有微信、元寶、WorkBuddy、騰訊文檔、遊戲。你在 WorkBuddy 裡用 Hy3 跑工作流,在元寶裡一句話生成 PPT,這套體驗離開騰訊生態就沒了。Google 把 Flash 嵌進 Copilot,全球開發者寫代碼就在用。 有分發渠道的平台方,最佳策略不是登頂排行榜,而是讓自家模型成為用戶不假思索的默認選項。智能正在變成商品,整合才是壁壘。 對獨立模型廠商來說這很難受,競爭同質化,替代成本太低。分數再高沒用,高級用戶有限,普通用戶根本不會切換,普通工作換模型區別也不大。除非在某個垂直能力上做到明顯領先,否則突破不了平台鎖定。 接下來一年,勝負手不在模型參數,在 Agent 穩態。誰的多步長鏈路工作流更穩、更省、更不出錯,誰就贏。掌握流量入口的 Google 和 腾訊路子走對了,商業化會走得更加順暢。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露