统一的多模态上下文
把文字指令与媒体参考放在一起,让模型理解不同素材应如何共同影响最终视频。
在上方生成器中使用 MiniMax H3,可从文字构思、首尾关键帧或多种参考素材出发,生成更可控的音画结果。根据手头已有的内容,选择最合适的创作方式。
当视频创意依赖多种输入之间的关系,而不只是一段提示词时,H3 能把这些信息放在同一个生成流程中处理。
把文字指令与媒体参考放在一起,让模型理解不同素材应如何共同影响最终视频。
在生成视觉内容的同时输出原生双声道,可根据创作描述加入对白、环境声、音效或音乐。
用自然语言指定主体、调度、节奏、镜头、视觉风格和声音线索,无需在多个独立工具之间反复切换。
可按发布渠道选择 4–15 秒时长、所需画幅,以及最高 2K 的分辨率。
三种生成方式既适合快速验证创意,也能用于制作更完整的营销和产品动态内容。
从简洁的创意简报出发,快速制作吸引注意力的场景、短版广告变体和音画社交内容。
让产品静态图动起来、连接规划好的关键帧,或在短视频中持续保持产品外观一致。
通过参考素材延续品牌视觉语言,用于动态海报、界面概念和新品发布演示。
在进入更长的制作流程前,先探索角色动作、镜头构思、整体氛围和声音方向。
生成前先了解如何选择模式、准备素材并编写更清晰的指令。
只有文字构思时选择文生视频;希望由一张图片或首尾帧确定画面时选择图生视频;角色、动作、风格或声音需要来自多份素材时,选择参考生视频。
可以。在图生视频模式中上传首帧和尾帧,再描述希望出现的动作与过渡,模型会围绕这两个关键画面生成过程。
MiniMax H3 支持随画面生成原生双声道。如果对白、环境声、音效或音乐会影响创意,请在提示词中明确说明。
生成器提供 4–15 秒时长,并支持最高 2K 的分辨率。具体可用组合以当前模式和表单中显示的参数为准。
为每份参考指定清晰用途,例如角色身份、产品外观、动作、运镜风格、人声或环境音。明确分工能减少素材之间的冲突。
它适合短广告创意、品牌与社交内容、电商展示、产品或 UI 演示、游戏概念,以及其他需要画面和声音协同的短视频项目。