Kuca.ai
読み込み中
プロンプト0 / 50,000
アスペクト比
長さ5秒
5秒15秒
解像度
64クレジット
残りクレジット
公開

高速なH3 Max生成・Kucaで4つの制作モード

MiniMax H3 Max:高速生成と精密なカメラ制御

MiniMax H3 Maxは、待ち時間を抑えながら完成度の高い動画を作りたいクリエイター向けのモデルです。詳細な指示への追従性と画面の仕上がりを高め、テキスト、画像、混合参照、カメラ制御の4つの制作方法に対応します。Kucaでは480P〜1080P、5〜15秒、6種類の運鏡プリセットを一つのワークスペースで扱い、企画からプレビューまでをより速く進められます。

MiniMax H3と比較する
生成速度
高スループット生成
参照素材
画像9枚・動画3本・音声3本
カメラ
6つのプリセット軌道
出力
480P〜1080P・5〜15秒

H3とH3 Max、クレジットを使う前に違いを確認

どちらも同じH3世代のモデルなので、選ぶ基準はそれぞれ何に向けて調整されているかです。H3 Maxはプロンプト追従、映像美、カメラ精度に寄り、MiniMax H3は2Kと同時生成のステレオ音声を担います。

項目MiniMax H3MiniMax H3 Max
得意な方向2Kのディテールとネイティブステレオ音声プロンプト追従、映像美、カメラ精度
解像度768P、2K480P、768P、1080P
長さ4〜15秒5〜15秒
参照素材画像5枚と音声3本まで画像9枚、動画3本、音声3本まで、合計12ファイル
カメラ制御プロンプトに記述選択できる6つの軌道プリセット
音声生成ネイティブステレオを映像と同時生成生成なし——音声は参照として入力
プロンプト長最大7,000文字最大50,000文字
スループットH3の標準パイプライン高スループットでより速く生成
MiniMax H3のページを開く

どちらのページも同じ生成画面を開くため、H3とH3 Maxを行き来しても指示を書き直す必要はありません。

説明するのではなく、選ぶ6つのカメラムーブ

左周回、右周回、ドリーイン、ドリーアウト、クレーンアップ、クレーンダウンの6種類から選べます。運鏡を設定として選ぶため、プロンプトは被写体、動き、場面の指示に集中できます。

左へ周回

カメラが被写体の周りを弧を描いて回り、被写体を中央に保ったまま背景が右へ流れます。

向いている用途商品の横顔や、被写体の背後の空間を見せたいとき。

右へ周回

同じ弧を逆方向に回り、背景は左へ流れます。

向いている用途既存素材の動きの向きに合わせたいときや、画面内の動きを追いたいとき。

ドリーイン

カメラが被写体へまっすぐ寄り、フレームが絞られていきます。

向いている用途顔、ラベル、ディテールの一部分を強調したいとき。

ドリーアウト

カメラが後退し、周囲の様子がフレームに入ってきます。

向いている用途被写体が実際どこにあるかを示して、カットを締めたいとき。

クレーンアップ

カメラが上昇し、視線が被写体へ見下ろすように動きます。

向いている用途シーンの導入や、場所のスケール感を見せたいとき。

クレーンダウン

カメラが被写体と同じ高さまで降りていきます。

向いている用途親密な目線の高さで着地させたいとき。

camera controlsモードは開始フレーム1枚とプリセット1つだけを必要とし、そのモードではプロンプトは任意です。アスペクト比はアップロードしたフレームに従います。

4つのエンドポイント、4つの異なる役割

H3 Maxのエンドポイントごとに求められる入力が異なり、モデルに委ねる範囲も変わります。先にエンドポイントを決めれば、参照素材を増やしすぎずに済みます。

  • 01

    テキスト動画

    あなたが用意するもの
    プロンプトだけ。ほかに何も要りません。
    モデルが決めること
    構図、被写体、照明、カメラ。
    使う場面
    方向性を探っている段階で、守るべきものが何もないとき。
  • 02

    画像動画

    あなたが用意するもの
    開始フレーム1枚と、任意で終了フレーム1枚。
    モデルが決めること
    動きとタイミング。構図は画像に従います。
    使う場面
    構図、人物の同一性、商品の形状をレンダリング後も保つ必要があるとき。
  • 03

    マルチモーダル参照

    あなたが用意するもの
    画像、動画クリップ、音声クリップ。それぞれに役割を明記します。
    モデルが決めること
    それらの参照を1つのショットにどう組み合わせるか。
    使う場面
    動き、スタイル、音を説明ではなく既存素材から取る必要があるとき。
  • 04

    カメラワーク

    あなたが用意するもの
    開始フレーム1枚と、6つのプリセットのうち1つ。
    モデルが決めること
    ムーブ中の被写体の振る舞い。軌道はプリセットから決まるためです。
    使う場面
    ショットの主な目的が、特定のカメラムーブを見せることであるとき。

参照ファイル1つにつき属性も1つだけ

H3 Maxは多くの素材を受け付けますが、役割が明確な小さなセットのほうが、互いに衝突する大きなセットより優れています。ファイルごとに仕事を1つ与え、その仕事をプロンプトに書きます。

素材担うもの上限よくある失敗
画像人物の同一性、製品形状、衣装、環境、配色。画像は最大9枚。ほぼ同じフレームを何枚も上げ、同じ属性を奪い合わせてしまう。
動画カメラの動き、リズム、ジェスチャー、素材の挙動。最大3本、各2〜15秒、合計15秒。カット、テキストのオーバーレイ、別の被写体が入った映像を渡してしまう。
音声声、音楽、環境音、効果音。最大3本、各2〜15秒、合計15秒。クリップが生成し直されると期待してしまう。音声は誘導であり出力ではありません。
プロンプト被写体、場所、アクション、カメラ、時間順、境界条件。最大50,000文字。曖昧な一文だけにする、または3つの筋を5秒に押し込む。

画像、動画、音声は合計12ファイルの上限を共有し、参照モードではそのうち少なくとも1つが必要です。

すべてのリクエストが照合される正確な範囲

これらの値は生成画面自身の設定に基づいています。ショットを組み立てながら確認するほうが、送信が弾かれてから調べるより速く済みます。

長さ
5〜15秒、整数秒のみ
解像度
480P、768P、1080P。既定は768P
アスペクト比(テキスト動画)
21:9、16:9、4:3、1:1、3:4、9:16
アスペクト比(参照モード)
上記6種に加えてadaptive
アスペクト比(画像・camera controls)
アップロードした開始フレームに従う
画像参照
最大9枚
動画参照
最大3本、各2〜15秒、合計15秒
音声参照
最大3本、各2〜15秒、合計15秒
参照素材の合計
最大12、参照モードでは最低1
プロンプト長
最大50,000文字

camera controlsモードは開始フレーム1枚とプリセット1つを受け付け、このエンドポイントではプロンプトは任意です。

テイクを最も無駄にする5つの失敗

H3 Maxの結果が期待外れになるとき、原因はモデルではなく指示か参照セットにあることがほとんどです。まず確認したいのは次のパターンです。

  • プロンプトで求めた内容が映像に反映されない

    起きる理由指示が曖昧すぎるか、無関係なアイデアがいくつも混ざっています。

    変えること具体的な名詞でアクションを1つ書き、カメラの挙動は別の文で示します。

  • ショットが慌ただしい、または動きの途中で切れる

    起きる理由5〜15秒の枠に詰め込んだ筋が多すぎます。

    変えること主となるアクションを1つに絞り、副次的なビートを削るか、詳細を足す前に長さを延ばします。

  • 文字、ロゴ、看板が歪む

    起きる理由元画像にすでに文字、ウォーターマーク、煩雑な背景が入っています。

    変えることクリーンなフレームから始め、文字をトリミングするか、画面内の文字を完全に排除します。

  • 被写体が参照から離れていく

    起きる理由同一性や色など、同じ属性を2つのファイルが静かに奪い合っています。

    変えること属性ごとに担当を1つに決めてプロンプトに明記し、重複するファイルを削除します。

  • 指定したカメラの動きをカメラが無視する

    起きる理由プリセットを想定したエンドポイントで、正確な動きを文章として書いています。

    変えることcamera controlsに切り替えて6つの軌道から1つを選び、プロンプトは被写体の振る舞いだけに使います。

H3 Maxが得意な4つのショット

各プランには、用意するもの、プロンプトの組み立て方、つまずきやすい点をまとめています。どのプロンプトもそのまま生成画面に読み込み、自分の素材に合わせて調整できます。

  • 縦型ソーシャルカット

    用意するもの
    クリーンな9:16または3:4の被写体画像。特定のムーブが重要な場合は短い参照クリップも用意します。
    プロンプトの構成
    被写体、場所、単一のアクション、カメラ、そして最後の1秒に欲しいビートの順に書きます。
    注意点
    5秒に物語全体を詰め込まないこと。アクションは1つに絞り、最後まで終わらせます。
  • 製品ターン

    用意するもの
    均一な面に置き、照明を整えた製品画像。印刷された文字や反射する物がないものが理想です。
    プロンプトの構成
    製品、面、カメラのプリセット、そのうえで照明と素材の指定を加えます。
    注意点
    最初に歪むのはパッケージの文字です。トリミングするか、ロゴが柔らかくなることを受け入れます。
  • オープンワールドのアクションビート

    用意するもの
    キャラクターと環境の画像、さらに再現したい動きを示す短いクリップを用意します。
    プロンプトの構成
    キャラクター、環境、1つのアクション、カメラ、そして連続性の境界の順に書きます。
    注意点
    見覚えのあるゲームや映画の素材を使い回すとIP上の問題を招きます。デザインはすべてオリジナルに保ちましょう。
  • 予告編風ティザー

    用意するもの
    キービジュアルと音楽の参照を用意し、1本の長いショットではなく短いテイクに分けてレンダリングします。
    プロンプトの構成
    5〜15秒のビートを並べたショットリスト。それぞれにカメラプリセットと単一のアクションを持たせます。
    注意点
    1回のリクエストで予告編全体はまかなえません。テイクごとに作り、編集ソフトでつなぎます。

素材はオリジナルか、適切にライセンスされたものを使用してください。ゲームのアセット、映画のフレーム、ロゴ、その他の保護されたキャラクターやブランドをアップロードせず、特定のシリーズを模倣するプロンプトも避けてください。

最初のH3 Maxレンダリング前によくある質問

MiniMax H3 Maxは、H3動画モデルをより高速かつ制御しやすくしたモデルです。プロンプト追従性と映像の仕上がりを高め、画像・動画・音声の混合参照と6種類の運鏡プリセットに対応します。


向上したのは2つです。ひとつはプロンプト追従、つまり書かれた指示にどれだけ忠実に映像が従うか。もうひとつは映像美、つまり完成フレームの照明、構図、グレーディングです。H3 Maxは速度のためだけに学習された大型モデルではありません。


H3 Maxは高スループットの推論向けに設計されており、標準のH3ワークフローよりショットを速く処理できます。実際の完了時間は解像度、尺、参照ファイル、キューの混雑状況で変わります。


H3 Maxはプロンプトにはるかに忠実に応え、画像と音声に加えて動画参照を受け付け、6つのプリセットカメラ軌道を備えます。2K出力や、映像と同時に生成されるネイティブステレオ音声が必要な場合は、MiniMax H3のほうが適しています。


480P、768P、1080Pで、既定は768Pです。長さは5〜15秒の任意の整数秒を選べます。MiniMax H3にある2Kの選択肢はH3 Maxにはありません。


画像9枚、動画3本、音声3本までで、合計は12ファイルが上限です。動画と音声はそれぞれ2〜15秒で、カテゴリごとに合計15秒の枠を共有し、参照モードでは少なくとも1つ必要です。


Kucaでは左周回、右周回、ドリーイン、ドリーアウト、クレーンアップ、クレーンダウンの6種類を選べます。カメラ制御は開始フレーム1枚とプリセット1つを使い、プロンプトは任意です。


いいえ。Kucaでは音声は入力です。2〜15秒の参照クリップを最大3本使え、声、音楽、環境音、効果音を固定できます。映像と一緒に音声を生成したい場合はMiniMax H3を使ってください。


被写体、場所、アクション、カメラ、時間順、そして出してはいけないものなどの境界条件を、この順に書きます。そのうえで5〜15秒のショットごとに主となるアクションを1つに絞り、テイク間で変える変数は1つだけにします。


曖昧なプロンプト、短い尺に複数の筋を詰め込むこと、すでに文字や雑然とした要素が入った元画像、そして同じ属性を奪い合う参照ファイルです。本ページの診断セクションで、それぞれの原因と対処を扱っています。


H3 Maxのショットを始める

制作モードを選び、指示や参照素材を追加して、KucaでH3 Maxの高速生成を始めましょう。