MiniMax近期推出的MiniMax Design引发关注,这款新产品被定位为“从操作像素到操作语义和表达意图”的工具,宣称用户无需调整参数、拉动时间线,只需用自然语言描述需求即可完成视频制作。然而,经过全面测试后发现,其流程设计确实简化了操作,但在核心的视频语义编辑功能上仍存在明显短板。
与传统AI视频工具不同,MiniMax Design被官方定义为“多模态模型驱动的生产力工作台”。其底层采用开源的H3多模态视频模型,通过封装多层Agent实现任务拆解、技能调用、模型生成和结果优化。用户输入需求后,系统会自动规划流程、生成分镜脚本并输出成片,整个过程用户仅需确认关键节点。这种设计在电商短视频、知识科普等标准化场景中表现出色,尤其适合需要批量生产内容的商业团队。
产品界面采用三栏布局:右侧为Agent对话区,中间是自动连线的画布,左侧集成技能广场、模板中心和素材库。官方提供的8个商用案例覆盖电商广告、KOC投流等场景,强调“短、快、模板化”的生产模式。定价方面,国内版会员分三档:65元/月可生成约83秒2K视频,499元/月对应870秒,1399元/月则支持2700秒生成量。对于日均需产出数十条素材的电商团队,这种计费模式具有成本优势。
在流程测试中,系统展现了较强的语义理解能力。当测试人员上传无线耳机图片并要求制作“15秒竖屏广告,突出轻便降噪,风格简洁科技感”时,Agent主动确认画幅、卖点和受众后,自动完成人物设计、脚本撰写和分镜生成。最终成片质量优于直接网页生成版本,原因在于Agent会自主扩展提示词并优化分镜逻辑。这种“所说即所得”的体验对AIGC新手尤为友好,用户无需掌握专业工具即可完成基础制作。
技能调用系统提供三种操作方式:直接点击试用、输入“/”唤起或由Agent自动匹配。测试中,三种方式均能准确执行指令,模板复用功能进一步降低了试错成本。项目级记忆功能则允许用户保存角色、场景等资产,支持跨项目调用。当测试人员连续对话多轮后,Agent能准确复述已确认的人物设定、视频风格和品牌信息,验证了系统对上下文的理解能力。
批量生产测试中,系统成功处理了更复杂的需求:上传两张产品图要求生成两条15秒KOC视频,每条需具备不同人设和开场。Agent通过建立人物锚和产品锚确保外观一致性,最终输出的两条视频在跨镜头表现上保持稳定。特别值得注意的是,在处理VR眼镜这类易混淆产品时,系统主动规避具体产品名称,转而描述佩戴感受,这种“自我纠错”能力虽非预设指令,却展现了模型对商业风险的规避意识。
3D导演台插件成为测试亮点。用户可用自然语言指令调整角色站位、机位角度,系统在3D空间预览构图后生成视频,将传统制作中的“抽卡试错”环节前置到分镜阶段。测试中,指令“摆两个角色面对面站立,侧面机位”被准确执行,生成视频的构图与预览分镜高度吻合。AI剪辑功能同样表现稳定,加字幕、转场和裁剪等指令均能精准完成。对于无法用语言描述的运镜需求,系统还支持通过手机扫码实现虚拟摄像机控制。
然而,在官方主推的语义级视频编辑测试中,系统暴露出明显缺陷。当测试人员要求“调暖色调、营造温馨氛围”时,成片几乎无明显变化;指令“更换为明亮咖啡馆背景”虽成功替换场景,但耳机产品出现严重变形。尽管Agent正确理解了意图并跳过参数确认环节,但模型在像素级保真和意图精准实现之间仍存在矛盾。这反映出当前技术在视频编辑场景的局限性——既要修改指定元素,又要保持其他内容不变,对模型能力构成双重挑战。
系统支持的开放工作流虽未完成本地部署测试,但其方向具有创新意义。官方提供的轻量版和满血版工作流可导入ComfyUI,允许专业用户自定义节点和参数。这意味着有显卡设备的创作者能将生成成本压缩至接近电费水平,同时保留Agent链路和画布流程。这种开放策略可能吸引两类用户:需要标准化生产的小团队,以及追求定制化的专业创作者。
对于电商运营团队,MiniMax Design的批量生产链路已具备实用价值,65元/月的入门档足够小规模试水。AIGC新手也能通过自然语言交互快速上手,降低学习门槛。但若用户期望实现“一句话精修视频”,仍需等待技术迭代。系统在对话、资产管理和流程控制方面已实现语义化,唯独核心的视频编辑功能尚未突破画面保真与意图实现的平衡点。当H3模型完成下次更新,或许真能推动视频编辑软件从菜单栏时代迈向语义操作时代。












