德國AI初創公司黑森林實驗室正式發佈多模態基礎模型Flux3。該模型基於Self-Flow架構打造,配備專用的圖像、視頻、音頻及動作編解碼器,實現了對物理與數字環境的統一理解與生成。

性能碾壓Luma與Runway,對標頂尖模型
作爲首款支持原生音頻生成的模型,Flux3 可一次性輸出長達 20 秒的音視頻同步片段,並涵蓋文本/圖像/視頻轉視頻、基於關鍵幀的轉場及多語言對話等功能。在720p分辨率、 10 秒片段的早期測試中,Flux3 性能以93%勝率超越Luma Ray3.2,以77%勝率碾壓Runway Gen-4.5,並在與Seedance2. 0 及Gemini Omni Flash等頂尖模型的對標中保持微弱優勢。
進軍機器人領域,分階段推出策略
公司聯合Mimic Robotics開發了適用於機器人領域的視頻動作模型Flux-mimic,目前已在奧迪工廠開展生產任務測試,將AI能力從純數字世界延伸到實體制造場景。BFL採取分階段推出策略,Flux3 Video現已上線,Flux3 Image與開源權重的"Flux3 Dev"也將在近期陸續發佈。
