阿里發布並開源 Qwen 3.8 Flash 模型,採用 125B MoE 架構,每 Token 僅激活約 6B 參數,原生支援 262144 token 上下文,可透過 YaRN 擴展至 1M token。該模型的創新之處在於能在消費級 4090 顯卡上運行,實現了資料中心級長文本模型向消費級硬體的遷移。更具競爭力的是其定價:每百萬 Tokens 輸入 0.8 元,輸出 2.7 元,價格僅為 DeepSeek-V4-Flash 的三分之一。實測顯示,模型可在 2 分鐘內完成四種平台文案撰寫,4 分鐘內完成會議記錄提取、表格整理和郵件生成。Qwen 3.8 Flash 已在千問辦公平台上線,API 接口同步開放。同日智譜也開源了 GLM-5.3-Flash,評測性能比肩 Claude Opus 4.8,價格為其四十分之一。文章作者、來源:量子位
Ali Qwen's new model has raised the bar once again.
他們發布並開源的 Qwen 3.8 Flash-Next,不僅價格直接秒殺 DeepSeek-V4-Flash,而且剛發布便摘得 Huggingface 榜首!

推特上的網友們也沸騰了,甚至還有工程師甩出實測影片直呼牛逼:
Qwen 3.8 Flash 打破了 VRAM 的門檻,資料中心級的長文本大模型,也能在消費級 4090 顯卡上運行!
還有人都興沖沖地把它用到了工作中。
不到 8 分鐘,它就跑完了涵蓋 Python 編程、多表分析和研究報告生成的一整套工作流程:

寶塔特效也不在話下:

哇哦,真的這麼炫嗎?我們當然也要親自試試。

每百萬 Tokens 輸入僅 0.8 元
Qwen3.8-Flash 採用 125B MoE 架構,每 Token 僅激活約 6B 參數,原生可支援 262144 token 上下文,並可透過 YaRN 擴展至 1M token。
同時,它也是 Qwen4 新架構的提前預演。
與 Qwen 3.7 Plus 相比,Qwen 3.8 Flash 不僅將激活參數減少至 1/3,訓練成本也僅為其 1/9,且在通用、數學推理、編程等能力上均更為強大。
更狠的是價格,Qwen 3.8 Flash 每百萬 Tokens 輸入僅 0.8 元,輸出 2.7 元,快取命中 0.1 元,價格最低至 DeepSeek-V4-Flash 的 1/3。
真的比拼多多砍一刀力度大得多(bushi

好吧好吧,既然價格已經卷到了這個份上,那咱也不客氣了,直接上強度,用兩個實測來探探 Qwen 3.8 Flash 在辦公場景實際的幹活能力吧。
實測一:為相機產品設計四種適配不同風格平台的文案
我們設計了一場「賽博文案挑戰賽」,讓 Qwen 3.8 Flash 在 1 元的額度內,將一份近萬字的相機產品資料改寫成小紅書、微博、抖音和朋友圈文案,看看它究竟能完成多少項任務。
提示詞如下:

發完提示詞後,我就去公司茶水間打了一杯水,全程不到 2 分鐘。
回來一看,四份不同平台的文案都已經全部寫好了,並且@對了品牌、風格、話題標籤拿捏得準準的(除了我不會那麼發那麼長的朋友圈之外hhh):




不到 2 分鐘肝完四份文案,“賽博打工人”的手速算是過關了。
但在職場中真正令人頭痛的,往往不是寫文案,而是開完會後誰來收拾這片狼藉。
於是,我們給它安排了第二份工作,考驗它的實戰辦公能力。
實測二:把一場產品週會變成可執行方案
我們以「智能客服 Agent V2.0 需求與技術評審會」為主題,原汁原味複刻了一份大家剛開完週會後可能會拿到的、同音錯字多且穿插著瑣碎閒聊的萬字原始會議實錄材料,並讓 Qwen3.8-Flash 一次性完成了提取總結、整理表格和會後通知郵件三項工作。
△ 圖片由 AI 生成,“token” 聽成 “偷啃” 真是有生活了
提示詞如下:

在預設模式下,不到 4 分鐘,Qwen3.8-Flash 就圓滿完成了所有任務,且五條核心結論總結、表格分工內容均準確無誤,郵件格式規範,收件人也與會議內容一一對應。



△ 部分測試結果圖
即使沒有要求,它也會主動為我們整理出會議中尚未達成結論的項目,方便我們下次會議繼續討論,be like:

而且到這一步,我的額度還沒燒完哦!
Ahahaha, this feeling of being unrestricted is so great.
現在,Qwen 3.8 Flash 已於「千問辦公」平台首發上線,API 接口也已同步開放,大家可以去試試啦!

還有一件事
中國大型模型的價格戰打得更激烈了。
就在 Qwen 3.8 Flash 開源的幾乎同一時間,智譜也開源了 GLM-5 系列首個原生多模態模型 GLM-5.3-Flash,也就是之前在網上爆火的「牛來」大模型 Ox Alpha。
在評測中,該模型的性能與 Claude Opus 4.8 相當,但價格已降至 GLM-5.3 的 1/10。

而且 GLM-5.3-Flash 還慷慨地推出了為期兩週的半價活動,意味著活動期間 GLM-5.3-Flash 的價格僅為 GLM-5.3 的 1/20、Opus4.8 的 1/40。

此外,Qwen 3.8 Flash 和 GLM-5.3-Flash 還有一個共同點,那就是他們這次都以超低的價格給 DeepSeek-V4-Flash 來了個措手不及(DeepSeek 騰騰地走開了):
△ DeepSeek-V4-Flash、Qwen 3.8 Flash、GLM-5.3-Flash 價格對比圖
無話可說,太卷了。
