Hailuo H3

可從文字或圖像同時生成原生2K影像與同步音聲。透過進階的多重參考控制與編輯功能,為商用等級的創意製作提供強力支援。

文字友善
支援音訊
商業用途

輸入

結果

閒置的

準備生成

配置輸入參數並點擊運行以產生影像預覽。

Hailuo H3 模型介紹

模型介紹

「Hailuo H3」是MiniMax開發的商用級尖端多模態影片生成模型,專門用於內容製作。它能整合理解文字、圖像、音訊、影片,可同時輸出原生2K解析度、24 fps的極高畫質影像,以及與影像完全同步的擬真音訊(包含對話、音效、背景音樂、環境音)。

其搭載滿足專業需求的進階編輯功能,包括「多參考(Omni-Reference)」控制,最多可同時輸入12個參考檔案(圖像、影片、音訊);能夠以自然語言指令進行部分影像與音訊編輯;還可實現影片間的動作遷移。此外,該模型在精準的文字描繪與品牌Logo渲染方面亦表現出色。

它為廣告、電子商務、遊戲、娛樂等領域中,尋求可立即上線的高品質影像製作的創作者與企業提供創新的工作流程解決方案。

價格介紹

解析度消耗積分(credits)
2k(credits/s)6

模型技術規格

技術參數具體規格
核心能力文字到影片
解析度2k
比例16:9,4:3,1:1,3:4,9:16,21:9
時長5,6,7,8,9,10,11,12,13,14,15

探索類似模型