Google 和 Meta 發布了競爭性 AI 模型 Gemini 3.8 Flash 和 Muse Spark 1.3

iconNS3
分享
AI summary icon精華摘要
Google 和 Meta 發布了競爭對手 AI 模型 Gemini 3.8 Flash 和 Muse Spark 1.3,其中 Meta 在代理知識工作和科學推理方面領先。鏈上分析顯示對這些模型有強烈興趣,反映恐懼與貪婪指數的變化。Gemini 3.8 Flash 的定價為每 100 萬個輸入代幣 $0.75,每 100 萬個輸出代幣 $3.75。Muse Spark 1.3 在 GDPval-AA v2 上獲得 1,754 Elo 分數,並在 Sierra Research 銀行代理測試中以 52.4% 的成績領先。

週三,Google 和 Meta 在數小時內相繼發布了對手的前沿 AI 模型。Google 發布了 Gemini 3.8 Flash 及其網路安全版本。Meta 則發布了 Muse Spark 1.3。Independent Testing by Artificial Analysis 表示,Meta 在代理知識工作和科學推理方面佔優勢。Google 在事實回憶和終端編碼方面領先。Gemini 3.8 Flash 是 Google 在六週內推出的第三款 Flash 模型。該模型的輸入代幣成本為每 1 百萬個輸入代幣 0.75 美元。輸出代幣成本為每 1 百萬個輸出代幣 3.75 美元。優惠價格有效期至 2026 年 12 月 31 日。之後價格將上調至每 1 百萬個輸入代幣 1.50 美元,輸出價格則上調至每 1 百萬個代幣 7.50 美元。Google 已向可信防禦者提供 Gemini 3.8 Flash Cyber 版本。該版本在 CyberGym 上得分為 86.2%,在 CWE-Bench 上得分為 47.2%。Google 表示,該模型為 Chrome 漏洞生成的正確修補程式數量是較大商業模型的 2.6 倍。Fairwind 計畫僅限政府機構和關鍵基礎設施運營商使用。OpenAI 則在前一天設定了類似的限制,針對 Astra。Meta 透過 Muse Code 和 Meta Model API 發布了 Muse Spark 1.3。公司工程師測量發現,與 1.2 版本相比,工具調用次數減少約 20%。Muse Spark 1.3 在 max 模式下於 GDPval-AA v2 上得分為 1,754 Elo。Gemini 3.8 Flash 在 high 模式下得分為 1,545。Muse Spark 1.3 在 Sierra Research 銀行代理測試中領先,得分為 52.4%;Gemini 3.8 Flash 則為 44.9%。Meta 在 CritPt 物理推理中也領先。Gemini 3.8 Flash 在 Terminal-Bench 2.1 中以 87.6% 領先,在 AA-LCR 長上下文測試中以 81% 領先,在 AA-Omniscience 準確性測試中以 55% 領先。Gemini 3.8 Flash 在測試模型中取得最高的 GPQA Diamond 分數,為 95%。在 Humanity's Last Exam 中,各模型分數相差不超過一點。Meta 表示,Muse Spark 1.3 的 max 推理功能將在完成進一步安全測試後推出。目前 xhigh 版本已可用,其在 Artificial Analysis 智能指數上的得分為 61,比 Muse Spark 1.2 高出四分,但仍低於 Claude Fable 5.1 的 66 和 Claude Opus 5 的 63。Elon Musk 表示,Grok 4.7 將很快推出。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露