Kuca.ai
加载中
提示词0 / 50,000
画幅
时长5s
5s15s
清晰度
64积分
剩余积分
公开

快速 H3 Max 生成 · Kuca 四种创作模式

MiniMax H3 Max:更快生成,精准控制镜头

MiniMax H3 Max 面向希望减少等待、同时保持成片质感的创作者。它更准确地遵循详细提示词,提升画面完成度,并支持文生视频、图生视频、混合参考和相机运镜四种工作流。在 Kuca,你可以更快地从创意进入预览,同时使用 480P–1080P 输出、5–15 秒时长和六种现成运镜。

与 MiniMax H3 对比
生成速度
高吞吐快速生成
参考素材
9 图 · 3 视频 · 3 音频
运镜
6 种预设轨迹
输出
480P–1080P · 5–15 秒

H3 还是 H3 Max?花积分前先看清差异

两个模型同属 H3 一代,因此选择的关键在于各自被调优的方向。H3 Max 偏向提示词贴合度、画面观感与运镜精度;MiniMax H3 仍是带联合生成立体声的 2K 模型。

对比项MiniMax H3MiniMax H3 Max
调优方向2K 细节与原生立体声提示词贴合度、画面观感与运镜精度
分辨率768P、2K480P、768P、1080P
时长4–15 秒5–15 秒
参考素材最多 5 张图片与 3 段音频最多 9 张图片、3 段视频与 3 段音频,合计 12 个文件
运镜控制写进提示词六种可选的轨迹预设
生成音频原生立体声,与画面一起生成不生成——音频只作为参考输入
提示词长度最长 7,000 字符最长 50,000 字符
吞吐量H3 基线推理管线高吞吐管线,生成等待更短
打开 MiniMax H3 页面

两个页面打开的是同一个生成器,因此在 H3 与 H3 Max 之间切换时不必重写简报。

六种运镜,选一下就好,不必用文字描述

从向左环绕、向右环绕、镜头推进、镜头拉远、镜头升高和镜头降低六种运镜中直接选择。把镜头方向变成明确设置后,提示词可以更专注于主体、动作和场景。

向左环绕

相机绕主体走弧线,主体始终居中,背景向右滑动。

适用场景展现产品侧面轮廓,或主体身后的空间。

向右环绕

同样的弧线,方向相反,背景向左滑动。

适用场景与已有素材的运动方向对齐,或跟随画面内的移动。

镜头推进

相机径直推向主体,画面随之收紧。

适用场景强调一张脸、一处标签或某个细节。

镜头拉远

相机后撤,周围环境进入画面。

适用场景在收尾时交代主体真正所处的位置。

镜头升高

相机上升,视线向下俯看主体。

适用场景为场景开场,或展现空间的规模。

镜头降低

相机下降到与主体齐平的高度。

适用场景落在一个亲近的平视收尾上。

相机运镜模式只需要一张首帧和一个预设,该模式下提示词是可选项。画面比例跟随你上传的首帧。

四个端点,四种不同的分工

每个 H3 Max 端点要求的输入不同,留给模型决定的空间也不同。先选定端点,参考素材才不会越堆越多。

  • 01

    文生视频

    你需要提供
    只有一段提示词,别的都不需要。
    模型来决定
    构图、主体、光线与运镜。
    适合场景
    还在探索方向,没有任何必须保留的内容。
  • 02

    图生视频

    你需要提供
    一张首帧,可选一张尾帧。
    模型来决定
    运动与节奏,构图则跟随你上传的图片。
    适合场景
    构图、身份或产品几何必须在渲染后保持不变。
  • 03

    混合参考

    你需要提供
    图片、视频片段与音频片段,每项都指明用途。
    模型来决定
    这些参考如何合成到同一个镜头里。
    适合场景
    运动、风格或声音必须来自现成素材,而不是靠文字描述。
  • 04

    相机运镜

    你需要提供
    一张首帧和六个预设中的一个。
    模型来决定
    运动过程中主体的表现,因为轨迹来自预设。
    适合场景
    这个镜头存在的主要目的就是展示某个特定的运镜。

每份参考素材只该负责一项属性

H3 Max 能接受大量素材,但职责清晰的小素材组胜过彼此打架的大素材组。给每份文件一个任务,并在提示词里写明这个任务。

素材负责什么上限常见失误
图片身份、产品外形、服装、环境或配色。最多 9 张图片。上传多张几乎相同的画面,争夺同一项属性。
视频一段运镜、一种节奏、一个手势,或某种材质的表现方式。最多 3 段,每段 2–15 秒,合计 15 秒。喂入带剪辑点、文字叠加或主体不一致的素材。
音频人声、配乐、环境声或音效。最多 3 段,每段 2–15 秒,合计 15 秒。以为音频会被重新生成:音频是引导,而非输出。
提示词主体、地点、动作、运镜、时间顺序与边界。最长 50,000 字符。只写一句含糊的话,或把三段情节塞进五秒里。

图片、视频与音频共用 12 个文件的合计上限,参考模式至少要添加其中一项。

每次请求都会对照的完整参数范围

这些数值来自生成器自身的配置。在组装镜头时顺手核对,比提交被拒之后再查要快得多。

时长
5–15 秒,仅支持整数秒
分辨率
480P、768P 或 1080P,默认 768P
画面比例,文生视频
21:9、16:9、4:3、1:1、3:4、9:16
画面比例,参考模式
上述六种比例,另加 adaptive
画面比例,图生与相机运镜模式
跟随你上传的首帧
图片参考
最多 9 张
视频参考
最多 3 段,每段 2–15 秒,合计 15 秒
音频参考
最多 3 段,每段 2–15 秒,合计 15 秒
参考素材总计
最多 12 个,参考模式下至少 1 个
提示词长度
最长 50,000 字符

相机运镜模式接受一张首帧和一个预设,该端点的提示词是可选项。

最容易浪费镜次的五类失败

大多数令人失望的 H3 Max 结果,根源在简报或参考素材,而不在模型。以下是最值得优先排查的几种情况。

  • 画面完全不理会提示词的要求

    原因简报要么过于含糊,要么混进了几件互不相关的事。

    怎么改用一个明确动作配合具体名词来描述,再用单独一句交代运镜。

  • 镜头显得仓促,或在动作中途就断了

    原因在 5–15 秒的窗口里塞进了太多情节。

    怎么改只保留一个主动作,去掉次要节拍;若还想加细节,先把时长拉长。

  • 文字、标识或招牌被渲染变形

    原因源图本身就带字、水印或杂乱的背景元素。

    怎么改从干净的画面起步,把文字裁掉,或干脆让画面里不出现任何文字。

  • 主体逐渐偏离参考

    原因有两份文件在暗中争夺同一项属性,比如身份或颜色。

    怎么改让每项属性只有一个来源,并在提示词里写明,然后删掉多余的那份文件。

  • 相机不执行你描述的运镜

    原因在需要预设的端点里,用散文写了一个精确的运动。

    怎么改切换到相机运镜,从六条轨迹里选一条,提示词只用来描述主体表现。

H3 Max 拿手的四类镜头

每份方案都列出要准备什么、提示词怎么组织,以及通常会在哪里出问题。任何一段提示词都可以直接载入生成器,再按自己的素材调整。

  • 竖屏社交短片

    准备
    一张干净的 9:16 或 3:4 主体图,若运镜有特定要求,再加一段短视频参考。
    提示词结构
    主体、地点、单一动作、运镜,最后是你想在末秒出现的节拍。
    注意
    不要把完整故事塞进五秒。只留一个动作,并让它做完。
  • 产品旋转

    准备
    一张打光良好、置于素净台面的产品图,最好不带印刷文字或反光杂物。
    提示词结构
    产品、台面、运镜预设,再补充光线与材质说明。
    注意
    包装上的文字最容易先变形。裁掉它,或接受更柔和的标识。
  • 开放世界动作节拍

    准备
    角色与环境图片,再加一段能示范你想要的运动的短片。
    提示词结构
    角色、环境、一个动作、运镜,然后是连续性边界。
    注意
    复用有辨识度的游戏或影视素材会招来 IP 风险。所有设计都要保持原创。
  • 预告片式前导

    准备
    一张主视觉和一段音乐参考,拆成几条短镜头分别渲染,而不是拍成一条长镜头。
    提示词结构
    一份由 5–15 秒节拍组成的镜头清单,每条各有自己的运镜预设和单一动作。
    注意
    一次请求撑不起一整条预告片。逐条生成,再在剪辑软件里拼起来。

源素材请保持原创或已获授权。不要上传游戏素材、影视画面、标识或其他受保护的角色与品牌,也避免使用模仿特定系列作品的提示词。

第一次跑 H3 Max 之前,大家常问的问题

MiniMax H3 Max 是速度更快、控制更直接的 H3 视频模型。它强化提示词遵循和画面质感,并支持图像、视频、音频混合参考以及六种现成运镜。


有两项素质得到提升:提示词贴合度,也就是成片对文字简报的遵循程度;以及画面观感,也就是最终画面的打光、构图与调色。H3 Max 并不是一个单纯为速度而训练的更大模型。


H3 Max 针对高吞吐推理进行了优化,因此通常能比基础 H3 工作流更快处理单个镜头。实际完成时间仍会受到分辨率、时长、参考文件和队列负载影响。


H3 Max 对提示词的响应更贴合,除图片和音频外还接受视频参考,并提供六种预设镜头轨迹。如果需要 2K 输出,或需要与画面一起生成的原生立体声,MiniMax H3 仍是更合适的选择。


480P、768P 和 1080P,默认 768P;时长可选 5 到 15 秒之间的任意整数秒。MiniMax H3 上提供的 2K 选项,H3 Max 没有。


最多 9 张图片、3 段视频和 3 段音频,合计上限 12 个文件。视频与音频每段为 2–15 秒,每类合计 15 秒额度,参考模式至少需要一份素材。


Kuca 提供向左环绕、向右环绕、镜头推进、镜头拉远、镜头升高和镜头降低六种可选运镜。相机运镜模式需要一张首帧和一个预设,提示词可以不填。


不会。在 Kuca 中音频是输入:最多 3 段 2–15 秒的参考音频,可用来固定人声、配乐、环境声或音效。如果你需要与画面一起生成的配乐,请使用 MiniMax H3。


按顺序写清六个部分:主体、地点、动作、运镜、时间顺序,以及边界条件,比如哪些内容不能出现。然后每条 5–15 秒镜头只保留一个主动作,两次尝试之间只改一个变量。


提示词含糊、把多条情节压进很短的时长、源图本身带有文字或干扰杂物,以及多份参考争夺同一项属性。本页的诊断一节逐条说明了原因和修改方式。


开始一条 H3 Max 镜头

选择创作模式,加入提示词或参考素材,直接在 Kuca 开始更快的 H3 Max 视频生成。