Qwen 3.8 Flash 將成本降至 DeepSeek-V4-Flash 的三分之一

iconMetaEra
分享
AI summary icon精華摘要
阿里巴巴的 Qwen 3.8 Flash 現已登陸 Qwen Office 平台,提供 125B MoE 架構,每個 token 激活 6B 參數。原生支援 262,144 個 token,並可在 4090 GPU 上運行。每百萬個輸入 token 價格為 0.8 人民幣,僅為 DeepSeek-V4-Flash 的三分之一。追蹤山寨幣動態的交易者可能將此視為關鍵發展。該模型可在四分鐘內處理複雜任務,且已準備好提供 API 服務。同日,智譜開源了 GLM-5.3-Flash,其價格為 Claude Opus 4.8 的四十分之一。隨著此類高性價比模型進入市場,包括恐懼與貪婪指數在內的市場情緒可能發生變化。
阿里發布並開源 Qwen 3.8 Flash 模型,採用 125B MoE 架構,每 Token 僅激活約 6B 參數,原生支援 262144 token 上下文,可透過 YaRN 擴展至 1M token。該模型的創新之處在於能在消費級 4090 顯卡上運行,實現了資料中心級長文本模型向消費級硬體的遷移。更具競爭力的是其定價:每百萬 Tokens 輸入 0.8 元,輸出 2.7 元,價格僅為 DeepSeek-V4-Flash 的三分之一。實測顯示,模型可在 2 分鐘內完成四種平台文案撰寫,4 分鐘內完成會議記錄提取、表格整理和郵件生成。Qwen 3.8 Flash 已在千問辦公平台上線,API 接口同步開放。同日智譜也開源了 GLM-5.3-Flash,評測性能比肩 Claude Opus 4.8,價格為其四十分之一。

文章作者、來源:量子位

Ali Qwen's new model has raised the bar once again.

他們發布並開源的 Qwen 3.8 Flash-Next,不僅價格直接秒殺 DeepSeek-V4-Flash,而且剛發布便摘得 Huggingface 榜首!

圖片

推特上的網友們也沸騰了,甚至還有工程師甩出實測影片直呼牛逼:

Qwen 3.8 Flash 打破了 VRAM 的門檻,資料中心級的長文本大模型,也能在消費級 4090 顯卡上運行!

圖片

還有人都興沖沖地把它用到了工作中。

不到 8 分鐘,它就跑完了涵蓋 Python 編程、多表分析和研究報告生成的一整套工作流程:

圖片

寶塔特效也不在話下:

圖片

哇哦,真的這麼炫嗎?我們當然也要親自試試。

圖片

每百萬 Tokens 輸入僅 0.8 元

Qwen3.8-Flash 採用 125B MoE 架構,每 Token 僅激活約 6B 參數,原生可支援 262144 token 上下文,並可透過 YaRN 擴展至 1M token。

同時,它也是 Qwen4 新架構的提前預演。

與 Qwen 3.7 Plus 相比,Qwen 3.8 Flash 不僅將激活參數減少至 1/3,訓練成本也僅為其 1/9,且在通用、數學推理、編程等能力上均更為強大。

更狠的是價格,Qwen 3.8 Flash 每百萬 Tokens 輸入僅 0.8 元,輸出 2.7 元快取命中 0.1 元,價格最低至 DeepSeek-V4-Flash 的 1/3。

真的比拼多多砍一刀力度大得多(bushi

圖片

好吧好吧,既然價格已經卷到了這個份上,那咱也不客氣了,直接上強度,用兩個實測來探探 Qwen 3.8 Flash 在辦公場景實際的幹活能力吧。

實測一:為相機產品設計四種適配不同風格平台的文案

我們設計了一場「賽博文案挑戰賽」,讓 Qwen 3.8 Flash 在 1 元的額度內,將一份近萬字的相機產品資料改寫成小紅書、微博、抖音和朋友圈文案,看看它究竟能完成多少項任務。

提示詞如下:

圖片

發完提示詞後,我就去公司茶水間打了一杯水,全程不到 2 分鐘。

回來一看,四份不同平台的文案都已經全部寫好了,並且@對了品牌、風格、話題標籤拿捏得準準的(除了我不會那麼發那麼長的朋友圈之外hhh):

圖片

圖片

圖片

圖片

不到 2 分鐘肝完四份文案,“賽博打工人”的手速算是過關了。

但在職場中真正令人頭痛的,往往不是寫文案,而是開完會後誰來收拾這片狼藉。

於是,我們給它安排了第二份工作,考驗它的實戰辦公能力。

實測二:把一場產品週會變成可執行方案

我們以「智能客服 Agent V2.0 需求與技術評審會」為主題,原汁原味複刻了一份大家剛開完週會後可能會拿到的、同音錯字多且穿插著瑣碎閒聊的萬字原始會議實錄材料,並讓 Qwen3.8-Flash 一次性完成了提取總結、整理表格和會後通知郵件三項工作。

圖片△ 圖片由 AI 生成,“token” 聽成 “偷啃” 真是有生活了

提示詞如下:

圖片

在預設模式下,不到 4 分鐘,Qwen3.8-Flash 就圓滿完成了所有任務,且五條核心結論總結、表格分工內容均準確無誤,郵件格式規範,收件人也與會議內容一一對應。

圖片

圖片

圖片

圖片△ 部分測試結果圖

即使沒有要求,它也會主動為我們整理出會議中尚未達成結論的項目,方便我們下次會議繼續討論,be like:

圖片

而且到這一步,我的額度還沒燒完哦!

Ahahaha, this feeling of being unrestricted is so great.

現在,Qwen 3.8 Flash 已於「千問辦公」平台首發上線,API 接口也已同步開放,大家可以去試試啦!

圖片

還有一件事

中國大型模型的價格戰打得更激烈了。

就在 Qwen 3.8 Flash 開源的幾乎同一時間,智譜也開源了 GLM-5 系列首個原生多模態模型 GLM-5.3-Flash,也就是之前在網上爆火的「牛來」大模型 Ox Alpha。

在評測中,該模型的性能與 Claude Opus 4.8 相當,但價格已降至 GLM-5.3 的 1/10。

圖片

而且 GLM-5.3-Flash 還慷慨地推出了為期兩週的半價活動,意味著活動期間 GLM-5.3-Flash 的價格僅為 GLM-5.3 的 1/20、Opus4.8 的 1/40。

圖片

此外,Qwen 3.8 Flash 和 GLM-5.3-Flash 還有一個共同點,那就是他們這次都以超低的價格給 DeepSeek-V4-Flash 來了個措手不及(DeepSeek 騰騰地走開了):

圖片△ DeepSeek-V4-Flash、Qwen 3.8 Flash、GLM-5.3-Flash 價格對比圖

無話可說,太卷了。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露