智谱發布並開源 GLM-5.3-Flash 多模態模型

iconKuCoinFlash
分享
AI summary icon精華摘要
智谱發布並開源了 GLM-5 系列首款原生多模態模型 GLM-5.3-Flash。該模型在性能上超越 GLM-5.2,程式設計與 Agent 分數接近 Claude Opus 4.8,但成本低 10%。基於 30T token 的多模態數據集,採用混合稀疏-線性注意力架構。在發布前,匿名的 Ox-Alpha 模型在當週登上 OpenCode 和 OpenRouter 首位。所有訓練均由國產晶片驅動。DeepSWE 測試顯示,在 10 個問題上準確率達 80%,但在較大樣本中降至 63%。權重現已開放,可透過 vLLM、SGLang 和 KTransformers 部署。鏈上新聞突顯了 AI 基礎設施的快速進展,而通脹數據對模型開發者而言仍是次要關注點。

Odaily 星球日報訊 智譜官方宣布上線並開源 GLM-5.3-Flash,這是 GLM-5 系列的首個原生多模態模型。

據悉,GLM-5.3-Flash 的整體性能超越 GLM-5.2,編程和 Agent 評測已接近 Claude Opus 4.8,但價格僅為 GLM-5.2 的十分之一。它還採用了全新的基礎模型,首次在 GLM 主系列中引入稀疏注意力與線性注意力混合架構,並使用 30T Token 的多模態數據進行預訓練。

智譜表示,為收集廣大用戶的廣泛、專業反饋,在正式發布前,以匿名模型 Ox-Alpha(中文社區稱作牛來)在 OpenCode 和 OpenRouter 上進行了大規模測試。Ox-Alpha 迅速成為當週最受歡迎的模型,創下雙平台調用量新高。而這些請求流量全部由國產晶片提供算力支持。

此前社區對 Ox Alpha 的 DeepSWE 小樣本測試曾達 80%,但當時僅有 10 道題。擴大樣本後,成績回落至約 63%,測試者也主動糾正了最初的說法。此成績仍屬第一梯隊,但未如最初 80% 那般誇張。權重開源後,開發者可直接使用 vLLM、SGLang、KTransformers 等框架自行部署,無需再通過匿名模型的 API。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露