MiniMax稀宇科技近日正式推出其全新力作——通用全模态生成模型MiniMax H3,标志着人工智能多模态技术领域迎来重要突破。该模型突破传统单模态限制,可同步处理文本、图像、视频及音频信息,实现跨模态内容的深度理解与精准生成。
技术团队介绍,MiniMax H3在音视频生成领域实现多项创新。模型支持原生双声道音频输出,视频生成分辨率最高可达2K,单段视频时长突破15秒限制。通过多模态统一编码架构,该模型能够精准捕捉不同形式数据间的关联性,在复杂场景理解方面表现出色。
商业应用测试显示,该模型在广告创意生成、品牌视觉设计、电商内容制作等领域展现显著优势。其特有的V2V Motion Transfer技术可实现视频动作的无缝迁移,配合精准的指令遵循能力,使内容创作者能够高效完成从概念设计到成品输出的全流程。在UI/UX设计场景中,模型对品牌元素的呈现准确率较前代产品提升40%以上。
公司技术负责人透露,MiniMax H3采用动态权重分配机制,可根据不同商业场景需求自动优化生成策略。为保障技术合规应用,官方将于近期分阶段开放模型权重,首批授权将优先覆盖通过合规审查的企业用户,具体开放时间表将在后续公告中披露。









