MiniMax Design 发布,视频模型有了自己的 Codex
2026/08/20 10:03阅读量 2
MiniMax 推出视频创作产品 MiniMax Design,将 H3 视频模型接入画布化工作流,支持自然语言驱动完成分镜、生成、剪辑等全流程。实测显示,用户只需描述需求,系统可自动生成完整视频,并能复用模板进行系列化生产,被视为视频模型版的 Codex。
事件概述
MiniMax 正式推出视觉创作产品 MiniMax Design,把此前开源的 H3 视频模型能力接入一套可编辑、可协作、可交付的完整工作流。这类似 GPT-5.6 Sol 与 Codex、DeepSeek V4 与 DeepSeek Harness 的组合逻辑:模型生成能力通过 Agent 和工程化流程放大为实际生产力。
MiniMax H3 于八月初开源,曾因高质量视觉表现引发关注。MiniMax Design 则进一步将 H3 与生图、音乐、语音等模型整合,用户只需描述需求,系统会自动拆解任务、创建画布、生成提示词、分镜图、配乐、台词、剪辑和字幕,最终输出成片。
核心能力
- 自然语言驱动全流程:无需手动编写提示词,用户输入需求后,MiniMax Design 会生成 Markdown 格式的 Brief 文档,并自动调用生图模型生成静态帧,再用 H3 生成视频。
- 可视化画布与专业工具:画布上可添加文本、图片、视频、音频,以及 3D 导演台、视频剪辑和 ComfyUI 工作流节点。3D 导演台支持在 3D 场景中摆放角色、调度机位,把模糊的自然语言要求转化为明确的空间运动参考,降低抽卡成本。
- 多模型协同:H3 负责逐段生成镜头,Agent 负责拆分任务、统一风格,并将多个片段重新组织为完整时间线,形成可执行的长视频生产流程。
- Skills 与模板复用:内置大量预设 Skill,支持将一套风格模板复用到新主题,快速衍生出不同平台版本和内容分支。
实测案例
- 复刻电影《牛来》片段时,仅输入场景描述并上传素材,系统自动搭建 3D 导演台,生成运镜参考并据此生成最终视频。
- 制作悬疑电影片头时,使用内置 Skill 自动完成分镜图、特效和动画,无需 PR/AE 手动合成。
- 生成 1 分钟 MV 时,从歌词、编曲、视觉风格、分镜、关键帧到字幕剪辑均由系统自动完成,H3 单次最长 15 秒的限制通过 Agent 拆分为多镜头再统一编排。
- 纸拼贴风格故事片可复用为科普视频模板,例如将同一套视觉包装用于解释日全食,并自动生成无字幕版、儿童旁白版等不同版本。
- 上传课程 PPT 可生成水墨风教育视频,上传诗歌可扩展为三分钟纪录片;电商场景中,产品图片可保留为独立节点,分别接入关键帧生成和剪辑流程。
值得关注
MiniMax Design 的意义在于把单一模型能力扩展为多模型协同的生产系统。对比此前依赖提示词的一次性生成,它让视频创作过程变得可修改、可迭代、可复用,是视频生成向“完整生产”迈进的一个典型产品化方向。
