Black Forest Labs 剛推出 FLUX 3,這是一款多模態 AI 模型,可生成 20 秒的同步音訊影片、處理圖像,並預測機器人動作。
該模型於 7 月 23 日以早期訪問形式推出,代表 BFL 首個真正整合的基礎模型。FLUX 3 在單一架構中運行於影像、影片、音訊與物理動作預測。
FLUX 3 實際上做什麼
主打功能為文字轉視訊生成,可產生長達 20 秒的片段,並內建與畫面同步的原生音訊。這意味著對話、音效和環境噪音都能與螢幕上的畫面精準同步,無需單獨生成音訊並手動拼接。
BFL 將其底層技術稱為「Self-Flow」方法,該方法可在一個統一系統中實現多模態數據的協同理解與生成。
初步評估顯示,該模型在與同行對比時表現出色。根據初步基準測試,FLUX 3 在 77% 的對比中優於 Runway Gen-4.5 等競爭模型。
分階段推出計劃將逐步擴展對視頻/音頻、圖像和動作功能的存取,並規劃推出開放權重的開發者版本。
從像素到生產線
BFL 已與 mimic robotics 合作開發 FLUX-mimic,這是一種已應用於奧迪生產線的模型變體。該系統可處理複雜任務,例如靈巧地操作材料,包括插入和處理柔軟材料,這些都是傳統機器人系統難以應對的。
BFL 的發展趨勢及其對投資者的意義
FLUX 3 遵循快速的開發節奏。FLUX 1 於 2024 年 8 月推出,FLUX 2 於 2025 年 11 月上線,而現在 FLUX 3 在大約八個月後到來。
財務支援與雄心相符。BFL 的 B 輪融資籌集了 3 億美元,公司估值達 32.5 億美元。
一個值得注意的細節:BFL 並未將任何加密代幣或數碼資產與 FLUX 產品線關聯。儘管其名稱與某些加密項目相似,但這是一家純粹由傳統風險投資資助的 AI 公司。

