テキストから自由にシーンを生成
元画像がない場合は、被写体、場所、動作、カメラ、光、終わり方を順に書きます。16:9、9:16、1:1から用途に合う構図を選べます。
文章からシーンを作る、1枚の画像を動かす、または開始・終了フレームで遷移を指定できます。KucaではKling 3.0 Videoを固定し、3〜15秒、720p・1080p・4K、テキスト生成用の3比率、音声スイッチなど実際に使える設定だけを表示します。
手元の素材に合うモードを選び、必要な長さと出力品質を一つの生成画面で設定します。
元画像がない場合は、被写体、場所、動作、カメラ、光、終わり方を順に書きます。16:9、9:16、1:1から用途に合う構図を選べます。
人物、商品、衣装、色、構図を固定したいときは開始画像を使い、その後の動作とカメラ移動をプロンプトで説明します。
変身、商品状態の変化、カメラ移動、マッチトランジションなど、終点が決まっているショットに向きます。
試作は720pまたは1080p、細部が必要な最終版は4Kを選択できます。必要クレジットは生成画面の最新表示で確認します。
良い結果を得るには、入力素材が固定する要素、動かしてよい要素、ショットの最後まで維持すべき要素を最初に整理することが重要です。
構図からモデルに任せる場合はテキスト動画生成を選びます。正確な開始画、人物、商品、アートディレクションがすでに決まっている場合は開始フレームを使い、開始と終了の両方が重要な場合だけ開始・終了フレームを選びます。モードによってプロンプトの役割も変わります。テキストモードでは場面全体を設定し、画像モードでは動き、連続性、提供した画像同士の関係を中心に説明してください。
開始状態、主な動作、カメラの移動、周囲の反応、終了状態の順に説明します。人物や物には一貫した呼び名を使い、服装、色、素材、位置関係を途中で変えないようにします。3〜15秒の映像で表現できる時間は限られるため、中心となる動作とカメラ演出を一つずつに絞ると意図が伝わりやすくなります。複数の場所や無関係な出来事が必要なら、別々に生成して編集時に接続してください。
意図しない文字、透かし、大きな遮蔽物、競合する被写体がない鮮明な画像を用意します。開始フレームを動かす場合は、完成映像で使いたい構図に近い状態へ先にトリミングします。開始・終了フレームでは、縦横比、人物や商品の同一性、空間構成、光の方向をできるだけ揃えてください。両端を意図的に変える場合は、その変化を文章で説明し、変えてはいけない属性を明示します。
プロンプトを試す段階では実用的な解像度を使い、動きと構図が安定してから高い設定へ進みます。長い尺を曖昧な動きで埋めるのではなく、主動作が自然に完了できる時間を選びます。音声を有効にする場合は、画面に合う台詞、環境音、効果音、音楽だけを指定してください。修正ごとに一つの主要変数だけを変えると、どの調整が結果に影響したか判断しやすくなります。
テキスト、開始画像、2枚の境界画像から選び、固定したい要素を整理します。
被写体とカメラの動きを時系列で書き、光や音を主動作に合わせます。
連続性と主動作を先に確認し、次に細部、安定性、音の同期を見ます。
登録済みのKling 3.0 Video仕様に沿ったコントロールだけを表示します。
被写体、場面、動作、カメラ、表現、必要な音を簡潔にまとめます。
テキストは画像不要、開始モードは1枚、開始・終了モードは2枚を使います。
短尺は一動作、長めはゆっくりした展開に向きますが、一つの連続場面に保ちます。
720p、1080p、4Kと音声設定によって必要量が変わるため、画面の最新合計を確認します。
初期モデルはKling 3.0 Video。同じKling系のTurboや旧版も比較できます。
承認済み画像がない環境や抽象的な動きに使います。
人物や商品が決まっているときに外観を守りながら動かします。
変化、公開、状態遷移など指定構図へ到達する映像に使います。
720p/1080pで十分ならTurbo、3〜15秒・4K・終了フレームが必要なら現在のモデルを選びます。
撮影前に人物配置、カメラ、空気感を検討します。
商品形状や素材を保って静止画を動かします。
9:16の短尺や縦長人物画像を動画化します。
開始画像で人物と衣装を固定します。
2枚の設計画像を滑らかにつなぎます。
移動経路、天候、環境音を指定します。
Kucaに統合されたKlingの動画生成ワークフローです。テキストからの動画生成、開始フレームからのアニメーション、開始・終了フレーム間の生成に対応します。このページでは最初にKling 3.0 Videoを選択し、実際に対応している長さ、解像度、比率、音声の設定だけを表示します。
テキストだけで始める方法、画像1枚を開始フレームとして使う方法、2枚の画像で開始と終了を指定する方法があります。このページのKling 3.0には、一般的な複数参照画像、参照動画、マルチモーダル参照のモードは表示されません。各画像には時間上の明確な役割があります。
現在の設定では、3秒から15秒まで1秒単位で選択できます。主な動作が明確に完了する長さを選び、尺を埋めるためだけに無関係な出来事を追加しないでください。短い映像は一つの仕草やカメラ移動、長めの映像はゆっくりした変化や見せ方に適しています。
生成画面では720p、1080p、4Kを選べます。高い解像度ほど必要なクレジットが増えるため、まず実用的な設定で動きと構図を確認し、方向性が固まった版に対して高精細な出力を使う方法が効率的です。解像度を上げても、不明確な指示や不整合なフレームが自動で直るわけではありません。
はい。音声を有効にして、画面の動作に合う台詞、環境音、効果音、音楽をプロンプトへ記載できます。互いに競合する複数の音声指示や、映像に関係のない音を同時に要求するのは避けてください。必要な音の種類とタイミングを簡潔に示すと確認しやすくなります。
テキスト動画生成では16:9、9:16、1:1を選択できます。画像を使うモードではアップロードしたフレームの構図が基準になるため、目的の向きに合わせて素材を準備してください。開始・終了フレームを使う場合は、両方の比率と主要被写体の配置を揃える必要があります。
一つのショットを時系列で書きます。最初に被写体と場所を設定し、主な動作を説明して、被写体の動きとカメラの動きを分け、最後に望む終了状態を記載します。スタイル、光、音声はその流れを支える場合だけ追加し、同じ人物や物にはプロンプト全体で同じ呼び名を使ってください。
終了時の構図が開始時と同じくらい重要な場合に2枚を使います。演出上の公開、変身、商品の状態変化、設計済みの2場面をつなぐトランジションに向いています。両端の人物や商品の同一性、画角、空間構成、光が近いほど、モデルが途中で不要な視覚的補正を作る必要が減ります。
必要なクレジットは映像の長さ、解像度、音声生成の有無によって変わります。生成画面に表示される合計が現在の設定に対応した最新値です。固定価格を本文で参照せず、設定を変更するたびに送信前の合計を確認してください。
はい。モデル選択はKlingファミリーに絞られており、Kling 3.0 Videoと利用可能なTurbo版や以前の版を比較できます。初期状態ではKling 3.0 Videoが選ばれ、別のモデルを選ぶと、そのモデルで利用できるモードと設定に画面が切り替わります。