MiniMax H3 AI 影片生成器:2K 畫質與原生立體聲
MiniMax H3 又稱 Hailuo 03,將文生影片、圖生影片、首尾幀控制與多模態參考生成整合在同一模型中。在 Kuca 可生成 4–15 秒的 768P 或 2K 影片,最多使用五張參考圖片與三段選填音訊,並同步生成原生立體聲。
用一個模型統一畫面調度、參考素材與聲音
MiniMax 將 H3 定義為通用多模態模型,可理解文字、圖片、音訊與目標影片之間的關係。Kuca 把這些可用能力集中在鎖定模型的生成器中。
統一的多模態理解
直接說明人物、動作、鏡頭語言與聲音參考應如何配合。H3 透過自然語言理解素材關係,不必把每項創意需求拆成彼此分離的專用任務。
原生 2K 細節
使用 768P 快速探索,或選擇 2K 保留紋理與製作細節。H3 的情境再生成會重新讀取原始多模態資訊,而不只是把低清結果一般放大。
原生立體聲音訊
讓對白、環境聲、音效與音樂隨畫面一起生成。立體聲方位與視聽節奏能讓動作、剪輯、台詞和空間聲音自然屬於同一場景。
彈性的 4–15 秒鏡頭
可選擇 4 到 15 秒之間的任意整數時長,並使用電影寬螢幕、橫向、方形或直向比例。首幀、尾幀與參考模式可進一步約束結果。
準備清楚的生成簡報
先選擇與任務相符的模式,為每份參考素材指定明確用途,再把鏡頭與聲音寫成一段協調且依序展開的指令。
選擇正確的起始模式
開放探索可用文生影片;需要固定構圖或角色時使用首幀;需要定向轉場時加入首尾幀;圖片與音訊必須共同約束結果時選擇多模態參考。
為每份參考指定職責
Kuca 中的 MiniMax H3 最多接收五張參考圖與三段選填音訊。明確每項素材用於人物、產品、環境、視覺風格、聲音、音樂、氛圍或音效。
依時間順序描述動作
依序寫出起始狀態、主要動作、鏡頭運動、場景變化與結束畫面。保持人物名稱和視覺特徵一致,並為每個動作預留完成時間。
設計立體聲聲場
寫明對白、空間底噪、音效與音樂,說明重要聲音出現的位置及其如何跟隨畫面。提交前一併檢查時長、解析度與畫面比例。
透過官方模型輸出體驗效果
2K 野生動物微距肖像
MiniMax 官方樣片保留睫角守宮眼睛、鱗片與吐舌動作的細節。可用範例提示詞探索棚拍光線、淺景深和精確的自然運動。
帶立體聲的復古未來高塔
鏡頭沿機械高塔向上移動,展示原生立體聲表現。可同步調度空間氛圍、機器聲、燈光與連續的建築鏡頭運動。
新黑色電影片頭
官方片頭樣片結合圖形分割、文字、剪影、物件與節奏剪輯。範例提示詞可把元素組織成帶同步聲音設計的短片頭。
適合的創意製作領域
影視片頭
製作標題序列、氣氛短片與提案視覺,統一控制蒙太奇、字體、轉場和聲音。
產品網站
為數位體驗生成產品動畫、功能展示、仿互動場景和發佈視覺。
動態海報
把靜態主視覺與角色設計轉成循環直向海報,控制景深、運動、構圖與氛圍。
廣告與電商
依據產品參考圖與清楚簡報製作產品亮相、生活風格鏡頭、品牌轉場與活動變體。
遊戲與虛擬世界
在完整製作前預演角色、介面、環境、過場動畫和風格化運動。
教育與解說
透過清楚步驟、旁白、音效和一致主體製作展示、課程與簡短概念解說。
MiniMax H3 常見問題
MiniMax H3 是 MiniMax 的通用多模態生成模型,也稱 Hailuo 03。它統一處理影片生成、參考關係、編輯關係與同步生成的原生立體聲音訊。
Kuca 支援文生影片、首幀圖生影片、首尾幀生成,以及使用圖片和選填音訊的多模態參考生成。
Kuca 的 MiniMax H3 生成器支援 768P 與 2K。快速探索可選 768P,需要更忠實的紋理與細節時可選 2K。
在 Kuca 可選擇 4 到 15 秒之間的任意整數時長,適合短動作、產品瞬間、轉場或完整的短場景。
可以。MiniMax H3 會隨畫面共同生成原生立體聲,包括對白、環境聲、音效與音樂,讓聲音跟隨動作和場景變化。
可以。只上傳首幀可讓固定構圖動起來;同時上傳首尾幀,則可引導影片在兩個明確的視覺狀態之間變化。
參考模式支援一至五張圖片,以及最多三段選填的 WAV 或 MP3 音訊;此模式必須至少加入一張參考圖片。
文生與參考模式支援 21:9、16:9、4:3、1:1、3:4 和 9:16;參考模式另有自適應比例,圖生模式跟隨上傳畫面。
像製作簡報一樣寫:先明確主體與環境,再依序描述動作和鏡頭,補充視覺風格,最後加入對白、氛圍、音效與音樂指示。
是。本頁能力影片與範例影片均來自 MiniMax 官方 H3 發佈資料;範例提示詞依據畫面整理,可直接用於已鎖定的 MiniMax H3 生成器。
