MiniMax 推出 H3 多模態模型,用於影片、圖像和音訊生成

iconChainthink
分享
AI summary icon精華摘要
鏈上數據顯示,MiniMax 於 2026 年 7 月 31 日推出其 H3 多模態模型,支援透過自然語言生成影片、圖像和音訊。該模型可一步完成運動轉移、角色參考和影片編輯。它能以每秒 0.13 美元的價格生成 15 秒的 2K 影片並搭配立體聲。MiniMax 將很快開放模型權重。隨著新工具不斷出現,AI 生成領域的恐懼與貪婪指數仍維持高位。

ChainThink 消息,7 月 31 日,據官方消息,MiniMax 發布全模態生成模型 H3,可同時理解文字、圖片、影片和聲音,並根據一條自然語言指令生成或編輯影片。

H3 支持將動作遷移、人物參考、聲音參考和視頻編輯放入同一項任務。例如,用戶可讓模型參考一段視頻的鏡頭運動、另一張圖片中的人物,以及第三段音頻的聲音。

該模型最長可生成 15 秒視頻,支援 2K 分辨率和原生雙聲道聲音。官方 API 價格方面,2K 為每秒 0.13 美元,生成 15 秒視頻約 1.95 美元;

768P 為每秒 0.09 美元。單次任務最多可上傳 9 張圖片、3 段影片和 3 段音訊,總數不超過 12 個檔案。

MiniMax 計劃在未來幾天開放模型權重,官方尚未公佈其與 Seedance、Veo 等模型的統一評測。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露