Kuca.ai
載入中
提示詞0 / 50,000
畫幅
時長5s
5s15s
解析度
64積分
剩餘積分
公開

快速 H3 Max 生成 · Kuca 四種創作模式

MiniMax H3 Max:更快生成,精準控制鏡頭

MiniMax H3 Max 面向希望減少等待、同時維持成片質感的創作者。它更準確地遵循詳細提示詞,提升畫面完成度,並支援文生影片、圖生影片、混合參考與相機運鏡四種工作流。在 Kuca,你可以更快地從創意進入預覽,同時使用 480P–1080P 輸出、5–15 秒片長與六種現成運鏡。

與 MiniMax H3 對比
生成速度
高吞吐快速生成
參考素材
9 圖 · 3 影片 · 3 音訊
運鏡
6 種預設軌跡
輸出
480P–1080P · 5–15 秒

H3 還是 H3 Max?花積分前先看清差異

兩個模型同屬 H3 一代,因此選擇的關鍵在於各自被調校的方向。H3 Max 偏向提示詞貼合度、畫面觀感與運鏡精準度;MiniMax H3 仍是具備聯合生成立體聲的 2K 模型。

對比項MiniMax H3MiniMax H3 Max
調校方向2K 細節與原生立體聲提示詞貼合度、畫面觀感與運鏡精準度
解析度768P、2K480P、768P、1080P
時長4–15 秒5–15 秒
參考素材最多 5 張圖片與 3 段音訊最多 9 張圖片、3 段影片與 3 段音訊,合計 12 個檔案
運鏡控制寫進提示詞六種可選的軌跡預設
生成音訊原生立體聲,與畫面一起生成不生成——音訊只作為參考輸入
提示詞長度最長 7,000 字元最長 50,000 字元
吞吐量H3 基準推論管線高吞吐流程,生成等待更短
開啟 MiniMax H3 頁面

兩個頁面開啟的是同一個生成器,因此在 H3 與 H3 Max 之間切換時不必重寫簡報。

六種運鏡,選一下就好,不必用文字描述

從向左環繞、向右環繞、鏡頭推進、鏡頭拉遠、鏡頭升高與鏡頭降低六種運鏡中直接選擇。把鏡頭方向變成明確設定後,提示詞可以更專注於主體、動作與場景。

向左環繞

相機繞著主體走弧線,主體始終居中,背景向右滑動。

適用情境展現產品側面輪廓,或主體身後的空間。

向右環繞

同樣的弧線,方向相反,背景向左滑動。

適用情境與既有素材的運動方向對齊,或跟隨畫面內的移動。

鏡頭推進

相機徑直推向主體,畫面隨之收緊。

適用情境強調一張臉、一處標籤或某個細節。

鏡頭拉遠

相機後退,周圍環境進入畫面。

適用情境在收尾時交代主體真正所在的位置。

鏡頭升高

相機上升,視線向下俯看主體。

適用情境為場景開場,或展現空間的規模。

鏡頭降低

相機下降到與主體齊平的高度。

適用情境落在一個親近的平視收尾上。

相機運鏡模式只需要一張首幀和一個預設,該模式下提示詞是選填的。畫面比例跟隨你上傳的首幀。

四個端點,四種不同的分工

每個 H3 Max 端點要求的輸入不同,留給模型決定的空間也不同。先選定端點,參考素材才不會越堆越多。

  • 01

    文生影片

    你需要提供
    只有一段提示詞,其他都不需要。
    模型來決定
    構圖、主體、光線與運鏡。
    適合情境
    還在探索方向,沒有任何必須保留的內容。
  • 02

    圖生影片

    你需要提供
    一張首幀,可選一張尾幀。
    模型來決定
    運動與節奏,構圖則跟隨你上傳的圖片。
    適合情境
    構圖、身分或產品幾何必須在算圖後保持不變。
  • 03

    混合參考

    你需要提供
    圖片、影片片段與音訊片段,每項都指明用途。
    模型來決定
    這些參考如何合成到同一個鏡頭裡。
    適合情境
    運動、風格或聲音必須來自現成素材,而不是靠文字描述。
  • 04

    相機運鏡

    你需要提供
    一張首幀和六個預設中的一個。
    模型來決定
    運動過程中主體的表現,因為軌跡來自預設。
    適合情境
    這個鏡頭存在的主要目的就是展示某個特定的運鏡。

每份參考素材只該負責一項屬性

H3 Max 能接受大量素材,但職責清楚的小素材組勝過彼此打架的大素材組。給每份檔案一個任務,並在提示詞裡寫明這個任務。

素材負責什麼上限常見失誤
圖片身分、產品外形、服裝、環境或配色。最多 9 張圖片。上傳多張幾乎相同的畫面,爭奪同一項屬性。
影片一段運鏡、一種節奏、一個手勢,或某種材質的表現方式。最多 3 段,每段 2–15 秒,合計 15 秒。餵入帶剪輯點、文字疊加或主體不一致的素材。
音訊人聲、配樂、環境聲或音效。最多 3 段,每段 2–15 秒,合計 15 秒。以為音訊會被重新生成:音訊是引導,而非輸出。
提示詞主體、地點、動作、運鏡、時間順序與邊界。最長 50,000 字元。只寫一句含糊的話,或把三段情節塞進五秒裡。

圖片、影片與音訊共用 12 個檔案的合計上限,參考模式至少要加入其中一項。

每次請求都會對照的完整參數範圍

這些數值來自生成器自身的設定。在組裝鏡頭時順手核對,比提交被拒之後再查要快得多。

時長
5–15 秒,僅支援整數秒
解析度
480P、768P 或 1080P,預設 768P
畫面比例,文生影片
21:9、16:9、4:3、1:1、3:4、9:16
畫面比例,參考模式
上述六種比例,另加 adaptive
畫面比例,圖生與相機運鏡模式
跟隨你上傳的首幀
圖片參考
最多 9 張
影片參考
最多 3 段,每段 2–15 秒,合計 15 秒
音訊參考
最多 3 段,每段 2–15 秒,合計 15 秒
參考素材總計
最多 12 個,參考模式下至少 1 個
提示詞長度
最長 50,000 字元

相機運鏡模式接受一張首幀和一個預設,該端點的提示詞是選填的。

最容易浪費鏡次的五類失敗

大多數令人失望的 H3 Max 結果,根源在簡報或參考素材,而不在模型。以下是最值得優先排查的幾種情況。

  • 畫面完全不理會提示詞的要求

    原因簡報不是過於含糊,就是混進了幾件互不相關的事。

    怎麼改用一個明確動作搭配具體名詞來描述,再用單獨一句交代運鏡。

  • 鏡頭顯得倉促,或在動作中途就斷了

    原因在 5–15 秒的窗口裡塞進了太多情節。

    怎麼改只保留一個主動作,去掉次要節拍;若還想加細節,先把時長拉長。

  • 文字、標識或招牌被算圖變形

    原因來源圖本身就帶字、浮水印或雜亂的背景元素。

    怎麼改從乾淨的畫面起步,把文字裁掉,或乾脆讓畫面裡不出現任何文字。

  • 主體逐漸偏離參考

    原因有兩份檔案在暗中爭奪同一項屬性,例如身分或顏色。

    怎麼改讓每項屬性只有一個來源,並在提示詞裡寫明,然後刪掉多餘的那份檔案。

  • 相機不執行你描述的運鏡

    原因在需要預設的端點裡,用散文寫了一個精確的運動。

    怎麼改切換到相機運鏡,從六條軌跡裡選一條,提示詞只用來描述主體表現。

H3 Max 拿手的四類鏡頭

每份方案都列出要準備什麼、提示詞怎麼組織,以及通常會在哪裡出問題。任何一段提示詞都可以直接載入生成器,再按自己的素材調整。

  • 直式社群短片

    準備
    一張乾淨的 9:16 或 3:4 主體圖,若運鏡有特定要求,再加一段短影片參考。
    提示詞結構
    主體、地點、單一動作、運鏡,最後是你想在末秒出現的節拍。
    注意
    不要把完整故事塞進五秒。只留一個動作,並讓它做完。
  • 產品旋轉

    準備
    一張打光良好、置於素淨檯面的產品圖,最好不帶印刷文字或反光雜物。
    提示詞結構
    產品、檯面、運鏡預設,再補充光線與材質說明。
    注意
    包裝上的文字最容易先變形。裁掉它,或接受更柔和的標識。
  • 開放世界動作節拍

    準備
    角色與環境圖片,再加一段能示範你想要的運動的短片。
    提示詞結構
    角色、環境、一個動作、運鏡,然後是連續性邊界。
    注意
    重複使用有辨識度的遊戲或影視素材會招來 IP 風險。所有設計都要保持原創。
  • 預告片式前導

    準備
    一張主視覺和一段音樂參考,拆成幾條短鏡頭分別算圖,而不是拍成一條長鏡頭。
    提示詞結構
    一份由 5–15 秒節拍組成的鏡頭清單,每條各有自己的運鏡預設和單一動作。
    注意
    一次請求撐不起一整條預告片。逐條生成,再在剪輯軟體裡拼起來。

來源素材請保持原創或已獲授權。不要上傳遊戲素材、影視畫面、標識或其他受保護的角色與品牌,也避免使用模仿特定系列作品的提示詞。

第一次跑 H3 Max 之前,大家常問的問題

MiniMax H3 Max 是速度更快、控制更直接的 H3 影片模型。它強化提示詞遵循與畫面質感,並支援圖片、影片、音訊混合參考以及六種現成運鏡。


有兩項素質得到提升:提示詞貼合度,也就是成品對文字簡報的遵循程度;以及畫面觀感,也就是最終畫面的打光、構圖與調色。H3 Max 並不是一個單純為速度而訓練的更大模型。


H3 Max 針對高吞吐推論進行最佳化,因此通常能比基礎 H3 工作流更快處理單一鏡頭。實際完成時間仍會受到解析度、片長、參考檔案與佇列負載影響。


H3 Max 對提示詞的回應更貼合,除圖片和音訊外還接受影片參考,並提供六種預設鏡頭軌跡。如果需要 2K 輸出,或需要與畫面一起生成的原生立體聲,MiniMax H3 仍是更合適的選擇。


480P、768P 和 1080P,預設 768P;時長可選 5 到 15 秒之間的任意整數秒。MiniMax H3 上提供的 2K 選項,H3 Max 沒有。


最多 9 張圖片、3 段影片和 3 段音訊,合計上限 12 個檔案。影片與音訊每段為 2–15 秒,每類合計 15 秒額度,參考模式至少需要一份素材。


Kuca 提供向左環繞、向右環繞、鏡頭推進、鏡頭拉遠、鏡頭升高與鏡頭降低六種可選運鏡。相機運鏡模式需要一張首幀與一個預設,提示詞可以不填。


不會。在 Kuca 中音訊是輸入:最多 3 段 2–15 秒的參考音訊,可用來固定人聲、配樂、環境聲或音效。如果你需要與畫面一起生成的配樂,請使用 MiniMax H3。


按順序寫清六個部分:主體、地點、動作、運鏡、時間順序,以及邊界條件,例如哪些內容不能出現。然後每條 5–15 秒鏡頭只保留一個主動作,兩次嘗試之間只改一個變數。


提示詞含糊、把多條情節壓進很短的時長、來源圖本身帶有文字或干擾雜物,以及多份參考爭奪同一項屬性。本頁的診斷一節逐條說明了原因和修改方式。


開始一條 H3 Max 鏡頭

選擇創作模式,加入提示詞或參考素材,直接在 Kuca 開始更快的 H3 Max 影片生成。