商汤科技近日面向全球开发者与创作者推出了一款开源的多模态大模型——SenseNova U1.5 Lite。该模型以轻量化设计为核心,通过原生统一架构实现多模态能力的深度融合,为AI视觉生成领域带来突破性进展。
在技术实现层面,研发团队针对真实场景中的视觉任务需求,对训练数据体系进行了系统性重构。通过优化任务设计逻辑与后训练流程,模型在视觉质量、复杂指令响应、文字与布局处理等关键维度实现显著提升。特别在原生4K分辨率支持、图像编辑功能及精细视觉控制方面,模型展现出更高的操作可控性与输出清晰度,有效降低了AI视觉生成的技术门槛与成本投入。
据公开技术文档显示,SenseNova U1.5 Lite通过创新的数据处理机制,解决了传统模型在真实场景应用中常见的稳定性问题。其原生支持的图像编辑功能可实现像素级操作,配合智能布局算法,能够满足商业设计、内容创作等领域的专业化需求。目前该模型已通过开源协议向全球社区开放,开发者可直接调用API进行本地化部署,快速构建个性化视觉应用。
行业分析指出,这款模型的开源将加速AI视觉技术的普惠化进程。其轻量化特性使得模型能够在消费级硬件上流畅运行,配合优化的性价比方案,有望推动视觉生成技术从实验阶段向规模化商业应用转型。技术社区的早期测试反馈显示,模型在广告素材生成、电商产品展示等场景中已展现出显著效率提升。











