向左環繞
相機繞著主體走弧線,主體始終居中,背景向右滑動。
適用情境展現產品側面輪廓,或主體身後的空間。
快速 H3 Max 生成 · Kuca 四種創作模式
MiniMax H3 Max 面向希望減少等待、同時維持成片質感的創作者。它更準確地遵循詳細提示詞,提升畫面完成度,並支援文生影片、圖生影片、混合參考與相機運鏡四種工作流。在 Kuca,你可以更快地從創意進入預覽,同時使用 480P–1080P 輸出、5–15 秒片長與六種現成運鏡。
兩個模型同屬 H3 一代,因此選擇的關鍵在於各自被調校的方向。H3 Max 偏向提示詞貼合度、畫面觀感與運鏡精準度;MiniMax H3 仍是具備聯合生成立體聲的 2K 模型。
| 對比項 | MiniMax H3 | MiniMax H3 Max |
|---|---|---|
| 調校方向 | 2K 細節與原生立體聲 | 提示詞貼合度、畫面觀感與運鏡精準度 |
| 解析度 | 768P、2K | 480P、768P、1080P |
| 時長 | 4–15 秒 | 5–15 秒 |
| 參考素材 | 最多 5 張圖片與 3 段音訊 | 最多 9 張圖片、3 段影片與 3 段音訊,合計 12 個檔案 |
| 運鏡控制 | 寫進提示詞 | 六種可選的軌跡預設 |
| 生成音訊 | 原生立體聲,與畫面一起生成 | 不生成——音訊只作為參考輸入 |
| 提示詞長度 | 最長 7,000 字元 | 最長 50,000 字元 |
| 吞吐量 | H3 基準推論管線 | 高吞吐流程,生成等待更短 |
兩個頁面開啟的是同一個生成器,因此在 H3 與 H3 Max 之間切換時不必重寫簡報。
從向左環繞、向右環繞、鏡頭推進、鏡頭拉遠、鏡頭升高與鏡頭降低六種運鏡中直接選擇。把鏡頭方向變成明確設定後,提示詞可以更專注於主體、動作與場景。
相機繞著主體走弧線,主體始終居中,背景向右滑動。
適用情境展現產品側面輪廓,或主體身後的空間。
同樣的弧線,方向相反,背景向左滑動。
適用情境與既有素材的運動方向對齊,或跟隨畫面內的移動。
相機徑直推向主體,畫面隨之收緊。
適用情境強調一張臉、一處標籤或某個細節。
相機後退,周圍環境進入畫面。
適用情境在收尾時交代主體真正所在的位置。
相機上升,視線向下俯看主體。
適用情境為場景開場,或展現空間的規模。
相機下降到與主體齊平的高度。
適用情境落在一個親近的平視收尾上。
相機運鏡模式只需要一張首幀和一個預設,該模式下提示詞是選填的。畫面比例跟隨你上傳的首幀。
每個 H3 Max 端點要求的輸入不同,留給模型決定的空間也不同。先選定端點,參考素材才不會越堆越多。
H3 Max 能接受大量素材,但職責清楚的小素材組勝過彼此打架的大素材組。給每份檔案一個任務,並在提示詞裡寫明這個任務。
| 素材 | 負責什麼 | 上限 | 常見失誤 |
|---|---|---|---|
| 圖片 | 身分、產品外形、服裝、環境或配色。 | 最多 9 張圖片。 | 上傳多張幾乎相同的畫面,爭奪同一項屬性。 |
| 影片 | 一段運鏡、一種節奏、一個手勢,或某種材質的表現方式。 | 最多 3 段,每段 2–15 秒,合計 15 秒。 | 餵入帶剪輯點、文字疊加或主體不一致的素材。 |
| 音訊 | 人聲、配樂、環境聲或音效。 | 最多 3 段,每段 2–15 秒,合計 15 秒。 | 以為音訊會被重新生成:音訊是引導,而非輸出。 |
| 提示詞 | 主體、地點、動作、運鏡、時間順序與邊界。 | 最長 50,000 字元。 | 只寫一句含糊的話,或把三段情節塞進五秒裡。 |
圖片、影片與音訊共用 12 個檔案的合計上限,參考模式至少要加入其中一項。
這些數值來自生成器自身的設定。在組裝鏡頭時順手核對,比提交被拒之後再查要快得多。
相機運鏡模式接受一張首幀和一個預設,該端點的提示詞是選填的。
大多數令人失望的 H3 Max 結果,根源在簡報或參考素材,而不在模型。以下是最值得優先排查的幾種情況。
原因簡報不是過於含糊,就是混進了幾件互不相關的事。
怎麼改用一個明確動作搭配具體名詞來描述,再用單獨一句交代運鏡。
原因在 5–15 秒的窗口裡塞進了太多情節。
怎麼改只保留一個主動作,去掉次要節拍;若還想加細節,先把時長拉長。
原因來源圖本身就帶字、浮水印或雜亂的背景元素。
怎麼改從乾淨的畫面起步,把文字裁掉,或乾脆讓畫面裡不出現任何文字。
原因有兩份檔案在暗中爭奪同一項屬性,例如身分或顏色。
怎麼改讓每項屬性只有一個來源,並在提示詞裡寫明,然後刪掉多餘的那份檔案。
原因在需要預設的端點裡,用散文寫了一個精確的運動。
怎麼改切換到相機運鏡,從六條軌跡裡選一條,提示詞只用來描述主體表現。
每份方案都列出要準備什麼、提示詞怎麼組織,以及通常會在哪裡出問題。任何一段提示詞都可以直接載入生成器,再按自己的素材調整。
來源素材請保持原創或已獲授權。不要上傳遊戲素材、影視畫面、標識或其他受保護的角色與品牌,也避免使用模仿特定系列作品的提示詞。
MiniMax H3 Max 是速度更快、控制更直接的 H3 影片模型。它強化提示詞遵循與畫面質感,並支援圖片、影片、音訊混合參考以及六種現成運鏡。
有兩項素質得到提升:提示詞貼合度,也就是成品對文字簡報的遵循程度;以及畫面觀感,也就是最終畫面的打光、構圖與調色。H3 Max 並不是一個單純為速度而訓練的更大模型。
H3 Max 針對高吞吐推論進行最佳化,因此通常能比基礎 H3 工作流更快處理單一鏡頭。實際完成時間仍會受到解析度、片長、參考檔案與佇列負載影響。
H3 Max 對提示詞的回應更貼合,除圖片和音訊外還接受影片參考,並提供六種預設鏡頭軌跡。如果需要 2K 輸出,或需要與畫面一起生成的原生立體聲,MiniMax H3 仍是更合適的選擇。
480P、768P 和 1080P,預設 768P;時長可選 5 到 15 秒之間的任意整數秒。MiniMax H3 上提供的 2K 選項,H3 Max 沒有。
最多 9 張圖片、3 段影片和 3 段音訊,合計上限 12 個檔案。影片與音訊每段為 2–15 秒,每類合計 15 秒額度,參考模式至少需要一份素材。
Kuca 提供向左環繞、向右環繞、鏡頭推進、鏡頭拉遠、鏡頭升高與鏡頭降低六種可選運鏡。相機運鏡模式需要一張首幀與一個預設,提示詞可以不填。
不會。在 Kuca 中音訊是輸入:最多 3 段 2–15 秒的參考音訊,可用來固定人聲、配樂、環境聲或音效。如果你需要與畫面一起生成的配樂,請使用 MiniMax H3。
按順序寫清六個部分:主體、地點、動作、運鏡、時間順序,以及邊界條件,例如哪些內容不能出現。然後每條 5–15 秒鏡頭只保留一個主動作,兩次嘗試之間只改一個變數。
提示詞含糊、把多條情節壓進很短的時長、來源圖本身帶有文字或干擾雜物,以及多份參考爭奪同一項屬性。本頁的診斷一節逐條說明了原因和修改方式。