MiniMax H3
Video Generator · 20 credits / 768p 5s video
MiniMax H3 video generation from text, start and end frames, or multimodal references.
使用 MiniMax H3 生成原生音视频。
MiniMax H3 视频核心能力
使用 MiniMax H3 视频生成器统一理解文本、图片、视频和音频参考素材,完成精细多模态编辑,保持字体与界面细节,并在同一条工作流中生成同步的原生立体声音频。
MiniMax H3 参考素材生成视频
一次 MiniMax H3 参考素材生成视频任务最多可以加入 9 张图片、3 段视频和 3 段音频。分别用它们控制人物与产品特征、表演、镜头运动、视觉风格、剪辑节奏、声音或音效,再把这些信号统一到一段连贯视频中。
MiniMax H3 精准视频编辑
通过自然语言进行 MiniMax H3 视频编辑:替换商品、重写画面文字、修改对白、调整场景光线,或添加与移除物体。精细多模态控制会聚焦你指定的变化,同时尽量保持人物、构图、动作、节奏和声音连贯。
文字、界面与品牌图形
使用 MiniMax H3 生成包含商品页面、游戏菜单、HUD、字幕、标题卡和动态 UI 的视频,并保持更清晰的文字与稳定的视觉结构。提示词最长支持 7,000 个字符,可以在一次 AI 视频提示词中完整描述分镜、界面动效、品牌元素、运镜和时间节奏。
MiniMax H3 原生音频
MiniMax H3 视频可以同步生成原生 32 kHz 立体声音频,包括对白、环境声、拟音、音效和与场景节奏匹配的音乐。加入音频参考还可以引导声音或表演,让声音从第一帧到最后一帧都与动作保持一致。
MiniMax H3 视频案例
浏览使用 MiniMax H3 制作的品牌短片、角色一致性视频、风格化动画、游戏视觉、动作迁移和精准 AI 视频编辑案例,了解同一个多模态视频模型可以完成哪些创作。
首尾帧生成
“把四张参考图片作为连续的 MiniMax H3 关键帧,并始终通过固定的复古双筒望远镜取景器观察场景。开场轻微失焦,快速推向装置,再随着商品细节出现完成拉焦。使用快速光学扫描、克制的运动模糊、胶片颗粒、柔和光晕和精准红色字体连接各个画面,同时保持双镜片遮罩位置完全固定。”
参考素材生成视频
“使用第一张图片固定人物身份、发型、银色头冠、蓝色多层服装和配饰,再用第二项参考素材控制分镜顺序与节奏。生成一段电影感 16:9 武侠视频,表现细腻手部动作、可控运镜、稳定面部细节、发光布料和每个剧情节点之间的自然转场。”
视频风格参考
“保留真人视频中的建筑、行人、时间节奏、镜头路径和自然光照,只把车辆与树木按照图片参考转换为具有触感的体素物体。保持所有运动符合物理规律,并让方块结构、阴影、反射和接触位置自然融入真实环境。”
MiniMax H3 文生视频
“创建一段 15 秒、16:9 的深夜自助洗衣店视频,把真人画面与手绘发光动画结合。场景包含闪烁的荧光灯、转动的洗衣机、玻璃反光、安静环境声和轻微怀旧氛围。采用单手手机临时拍摄的感觉,保留轻微抖动、曝光变化、延迟对焦,以及穿过空间的神秘发光生物。”
动作参考
“匹配参考视频中的完整动作顺序、固定广角机位和时间节奏,但把表演者替换为三只写实水豚。保留每一次倒地、翻滚、跳跃、位置交换和最终叠成金字塔的动作,并在不改变原始编舞的前提下还原真实毛发、重量感、地面接触、光照和阴影。”
MiniMax H3 视频编辑
“移除源视频中的绿幕背景,并根据第二段视频生成电影感童话环境。让新场景与人物动作、镜头透视和时间节奏保持一致,重新调整人物光线、接触阴影和整体色彩,使前景人物与生成背景看起来属于同一个连续镜头。”
MiniMax H3 在线工作流
从提示词或参考素材开始,选择与输入匹配的 H3 生成模式,再设置时长、画幅和声音方向,然后生成视频。
在一条提示词中写明主体、动作、环境、镜头运动、对白、音效和音乐。如果需要保持人物、产品、风格、动作或声音一致,就上传对应参考素材。
新场景使用文生视频;固定开场画面使用图生视频;控制转场使用首尾帧模式;混合图片、视频和音频输入则使用参考素材模式。
设置模型支持的画幅、时长、分辨率和原生音频选项后开始生成。检查画面一致性与声音同步,再把结果用于后续创作工作流。
了解 MiniMax H3 视频生成、输入素材、原生音频、输出规格、提示词、价格,以及 EZMiniMax 与 MiniMax 的关系。
MiniMax H3 是全模态生成视频模型,可以在同一个上下文中理解文字、图片、视频和音频,并生成带原生立体声音频的视频,包括对白、环境声、音效与音乐。
MiniMax H3 支持文字提示词、首帧与尾帧图片,以及混合参考素材。参考模式最多可使用 9 张图片、3 段视频和 3 段音频,单次请求不超过 12 个文件;音频参考需要与图片或视频一起使用。
可以。上传图片作为首帧,再描述主体、场景与镜头应该如何运动。MiniMax H3 会从这张视觉锚点继续生成镜头,并同步生成对白、音效、环境声和音乐。
会。MiniMax H3 会随视频原生生成 32 kHz 立体声音频。你可以在同一条提示词中描述对白、音效、环境声和音乐,让声音与画面的时间和关系一起被建模。
MiniMax H3 支持 4 至 15 秒、24 FPS 的视频,并覆盖常见横屏、方形、竖屏和电影画幅。基础工作流使用 768 像素短边,完整官方再生成工作流最高可输出 2K。
不是。EZMiniMax 是独立的多模型创作平台,与 MiniMax 及其关联方不存在隶属、关联或背书关系。第三方模型和公司名称仅用于识别兼容工作流;当前支持情况请以产品内模型选择器为准。
参考素材生成允许在一次请求中混合图片、视频和音频。你可以告诉 MiniMax H3 每项参考素材应该用于控制人物或产品、视觉风格、动作、镜头运动、剪辑节奏或声音。
描述完整的音视频时间线:先写场景和主体,再写动作、镜头切换、运镜、对白、音效、环境声与音乐。使用参考模式时,要明确指定每张图片、每段视频或音频负责控制什么。
生成成本取决于所选时长、分辨率和工作流。EZMiniMax 使用积分,并会在产品内生成前展示当前任务成本;可在价格页面查看套餐和积分包。
能否商用取决于当前 MiniMax H3 许可与提供方条款、你的 EZMiniMax 套餐,以及提示词、上传素材、参考内容、品牌、人物和生成内容所涉及的权利。发布前请查看适用条款并确认拥有必要授权。