8月3日,MiniMax正式開源其首款多模態生成模型MiniMax H3。消息公佈當日,摩爾線程便依託其AI訓推一體智算卡MTT S5000及MUSA軟件棧,迅速完成了該模型的極速適配與高效運行。
作爲MiniMax在多模態領域的全新力作,H3打破了傳統單任務的界限,能夠在多元上下文中精準理解創作意圖,並全面支持文本、圖片、音頻以及視頻的綜合輸入。據官方介紹,該模型可直接輸出2K分辨率、最長15秒的原生音畫內容,在性能與實用性上具備商用級多場景生成能力。
值得關注的是,H3在Artificial Analysis視頻模型榜單中斬獲了“視頻編輯能力全球第一”的成績,其2K分辨率視頻生成價格更低至每秒0.8元,兼具極高的商業性價比。同時,其開源屬性大幅降低了應用門檻,不僅支持企業本地化靈活部署與自有數據定製,還能有效滿足安全合規需求,加速推動多模態生產力的廣泛普及。
面對模型的全新發布,摩爾線程團隊展現出了極高的響應效率。在模型開源當日,其研發團隊迅速展開模型架構拆解、核心技術分析及典型算子梳理,僅用3小時便打通了從SGLang-MUSA推理框架到MATE、muDNN高性能算子庫的完整適配路徑,實現了H3在MTT S5000上的快速部署與穩定運行。
摩爾線程表示,未來將與MiniMax持續深化合作,共同在多模態領域探索更強的上下文理解能力與更大模型規模,全面加速AGI技術的創新與產業化落地。
