現在,一個 AI 模型生成影片的速度比你觀看的速度還快。Fal 工程師 Rehan Sheikh 使用 H3 Max(公司針對 MiniMax H3 影片生成模型的優化版本)設置了一個直播,能在約 9 秒內生成 15 秒的影片內容。結果是產生了一個連續的自動化串流,AI 實際上生成畫面的速度快於實時播放。
H3 Max 的實際功能
H3 Max 於 2026 年 8 月 27 日推出,為 MiniMax H3 的封閉式後訓練版本,MiniMax H3 是於 2026 年 7 月推出的開放權重多模態模型。
該模型可在 3 秒內生成 768p 或 720p 分辨率的 5 秒片段,部分測試顯示其耗時約為 2.5 秒。對於更長的片段,15 秒的生成時間取決於解析度和設定,介於 9 至 16 秒之間。
根據獨立基準測試,H3 Max 的吞吐量最高可達其前代產品的 35 倍。同時,在圖像轉視頻並帶音頻的表現中,其在品質、美學和提示理解方面的人類偏好測試中排名第一位。
在定價方面,fal 正提供促銷價,約為每 5 秒 480p 影片 12.5 美分,更高解析度的費用將翻倍。
直播實驗及其平台歷程
謝赫的實驗是對一種持續進行、完全由 AI 實時生成的視頻串流的概念驗證。無任何預渲染素材,無人工操作員選擇片段。
該直播於2026年8月29日左右啟動。Sheikh 最初在 Twitch 上進行直播,但很快便遇到問題。隨後直播遷移至 Kick,卻又遭遇類似的摩擦。兩個平台均透過其審核系統標記了該內容。Rumble 最終成為該直播的落腳點,其較為寬鬆的內容審核方式為此實驗提供了更友善的環境。
為何快於實時至關重要
當生成速度超過播放速度時,以往不切實際的使用情境變得可行:永不下線的自動化內容頻道、即時個性化影片推送,或能夠即時產生客製化創意素材而無需渲染佇列的廣告流程。
吞吐量差距——為前代產品的 35 倍——表明收益主要來自架構改進,而非單純的硬體擴展。
Twitch 和 Kick 拒絕 Sheikh 的直播,是早期的摩擦信號,隨著這些工具的普及,這種摩擦只會加劇。Rumble 願意主辦該直播,使其成為實驗性 AI 內容的潛在歸屬地。
