MiniMax Design 发布:H3 视频生成创作工作流

Admin
107阅读
0评论
0点赞

MiniMax 官方发布创作工作台 MiniMax Design,将开源视频模型 H3 接入从需求理解、分镜规划到自动剪辑的完整流程。实测显示,它支持电商种草、杂志风 MV、3D 导演台等场景,通过 Agent 驱动实现批量生产,标志着视频 Agent 从套壳走向原厂深度适配。

MiniMax Design 是 MiniMax 官方推出的创作工作台,它把开源视频生成模型 H3 接入从需求理解、分镜规划、逐镜头生成到自动剪辑的完整流程。我们实测后发现,它不同于普通视频生成工具:只要用自然语言描述需求,Agent 会自动规划并执行,还能复用整条制作链路,让批量生产商业内容成为可能。

MiniMax Design 是什么?

MiniMax Design 是一款由 Agent 驱动的视频创作工作台。它做的事情是先理解用户需求,再拆解为制作步骤:确定画面风格、规划镜头数量和运镜、生成分镜参考、逐镜头生成,最后自动剪辑拼接。用户可以中途修改,也可以让它自动跑完全程。

MiniMax Design 工作台界面

从实测来看,MiniMax Design 更适合人物口型要求较高、物理细节不极端、镜头目标明确的内容,例如种草短片、电影片头、特效包装、教育科普动画和短 MV。

它还接入了 ComfyUI。之前在 ComfyUI 上搭建过工作流的用户,可以一键迁移过来,其他平台的成熟工作流也能导入。

从一条片子到一套商业内容工作流

我们做了三个实测场景:前两个看生成质量,第三个看可控性。

第一个测试:电商 KOC 种草短片

输入要求很简单:15 秒智能手表测评视频,男性博主视角,锤子砸表面测试硬度,无旁白纯画面。

Agent 接到需求后,会选择合适的 Skill 进行调用。

Agent 选择 Skill

随后它会让我确认产品外观、测试动作、画面调性等关键信息,补充之后就开始执行。

生成过程中的确认界面

整体生成速度和体验比传统抽卡更轻松。它的运镜设计也很专业,从产品特写推到锤子落下的动态镜头,节奏感不错。

运镜效果展示

更关键的是,Design 里的整套工作过程可以复用。将来换产品品类,比如把手表改成扫地机器人或瑜伽裤,只需要调整产品描述和场景设定,制作链路直接套用。这很像视频领域的 Codex。

工作流复用示意

第二个测试:杂志风设计

这个方向是 H3 本身擅长的领域。我输入的提示词是:生成一个动漫角色风格的 15 秒复古潮流拼贴 MV,包含街头海报墙、复印 zine、VHS、halftone、黑白红配色、英文大字动态字体,K-pop hip-hop 节奏。

这次会触发杂志风相关的 Skill,然后一键完成。

杂志风 Skill 触发

成片效果依然很惊艳。

杂志风 MV 效果

第三个测试:3D 导演台

3D 导演台是我觉得最有意思的部分。我设定了一个七夕场景:夜晚,男生和女生沿街道并肩走,城市上空烟花绽放,两人停下仰头,男生悄悄牵手女生。

Agent 接到描述后,自动在 3D 场景中摆放角色素体,设置机位和运镜路径。我可以手动微调,也可以让它自己规划。

3D 导演台场景布局

这个 3D 运镜是动态的,可以作为视频参考素材,并直接导入到对话中用于生成最终画面。

3D 动态运镜参考

之后继续创作,Agent 先根据需求生成首帧,再生成完整视频。大约七分钟后,七夕特制视频就完成了。

3D 导演台生成成片

MiniMax Design 的效果

市面上不缺视频生成工具,也不缺调用 H3 的第三方 Agent。MiniMax Design 的差异点在于:它不仅会生成,而且让创作可以稳定批量生产。

真正值得关注的是:

  • Design 的 Agent 原生内置 H3 的专业级提示词模板,提示词小白也能把模糊需求翻译成模型最容易理解的语言。
  • 视频 Skill 生态丰富,不同类型内容的制作逻辑被封装成可触发的 Skill,系统会根据需求自动组合。
  • 3D 导演台把「抽卡」变成「导演」,创作者能精确控制构图和人物位置,大幅降低试错成本。
  • 生成完镜头后还能自动剪辑、自动加字幕,相当于一个轻量版剪映,补上了从生成到交付的最后一公里。

一句话总结:H3 是模型能力,MiniMax Design 的 Harness 是生产能力。模型决定天花板,Harness 决定模型能力能否真正变成面向真实世界的交付。

Agent 领域也有自己的斩杀线

MiniMax Design 发布背后,还有一个更明显的行业信号。

文本模型领域,几乎所有厂商都在推出自己的 harness 框架,比如 GLM 的 ZCode、DeepSeek 的 Deepseek-harness。模型公司比任何人都更懂自己模型的能力边界,所以它们主动向上延伸,把模型能力构建成完整生产链路。

视频领域正在出现同样的事情:MiniMax 做 Design,不是只提供 API 接口,而是打通从需求理解到成片交付的整条路径。这很像 Claude Code 对软件开发行业的冲击——当模型公司自己下场做开发工具,传统 IDE 的护城河瞬间变薄。

Adobe 的处境很有意思:2026 Q1 收入 64 亿美元创纪录,但股价照跌,因为投资者担心 AI Agent 会削弱 seat-based 软件模式的需求。Adobe 也在尝试通过接入第三方视频生成模型来应对,但它的 AI 是长在时间轴和图层之上的,能理解操作,理解不了意图,服务的依然是已经会做视频的人。

MiniMax Design 的 AI 长在模型之上,用户只要用自然语言说清需求,它就能接住,并把门槛从剪辑师扩张到所有有内容需求的人。同时,它没有放弃精准控制:分镜重生成、逐句改台词都在,自然语言负责 0 到 80 分,结构化编辑负责 80 到可交付。

模型公司做 Agent 有一个天然优势:对模型的适配是极致的。Design 里 Agent 的每一次规划、每一条提示词、每个 Skill 触发逻辑,都基于对 H3 能力边界的深度理解——这种原厂级适配,第三方平台很难复制。

所以我们的判断是:视频 Agent 的套壳时代可能正在结束。H3 的开源把「斩杀线」蔓延到视频模型圈,Design 的发布则给只做前端、底层调用别人 API 的视频 Agent 带来巨大压力。当模型厂商自己下场,用更极致的价格、更深的适配、更完整的链路做产品,纯套壳空间会被急剧压缩。

未来视频领域最强的 Agent,大概率属于模型厂商自己。对于需要批量生产电商素材、买量素材、教育科普动画和品牌宣传片的团队,MiniMax Design 是目前值得尝试的方向。

上一篇GLM-5.3 量化239GB,Mac Studio 可跑下一篇Qwen4预览架构:Qwen3.8去拒绝版实测
评论0

暂无评论,期待您的发言...

发表评论