根據 動察 Beating 監測,BOSS 直聘旗下南北閣實驗室開源 Nanbeige4.2-3B。它僅約 30 億參數,卻能同時修改代碼、處理辦公文件、調用複雜工具和操作終端。官方測試顯示,它在多項通用 Agent 和代碼 Agent 評測中,超越參數更大的 Qwen3.5-9B 和 Gemma4-12B。在 SWE-Bench Verified 上,它獲得 63.6 分,Qwen3.5-9B 為 53.1 分,Gemma4-12B 為 44.2 分。Nanbeige4.2-3B 會讓同一組模型層重複計算兩遍,以更多計算換取更強能力。這樣無需增加參數,也能讓小模型處理更複雜的任務,但推理需要更多算力和時間。南北閣希望用小模型降低 Agent 的連續調用成本。Nanbeige4.2-3B 已開放模型權重,支援 Transformers、SGLang、vLLM、llama.cpp 和 Ollama。
BOSS 直聘開源 3B 代理模型 Nanbeige4.2,在測試中表現優於更大模型
MarsBit分享
BOSS 直聘的南閣實驗室已開源 Nanbeige4.2-3B 模型,這是一個擁有 30 億參數的代理模型,在程式碼和通用基準測試中表現優於更大規模的模型。在 SWE-Bench Verified 上,其得分為 63.6,超越了 Qwen3.5-9B 和 Gemma4-12B。該模型透過重複層計算來提升效能,而無需增加參數數量。監控未平倉合約的交易者可能觀察到對 AI 工具需求的變化。權重現已支援主要框架,旨在降低代理呼叫成本。恐懼與貪婪指數的波動可能反映市場對開源 AI 進展的反應。
來源:顯示原文
免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。
虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款和風險披露 。