ITBear旗下自媒体矩阵:

商汤SenseNova U1.5 Lite正式开源:轻量高效助力AI视觉生成升级

   时间:2026-08-21 20:19:10 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

商汤科技近日宣布,其研发的轻量级多模态大模型SenseNova U1.5 Lite正式面向全球开源。这一版本在预览版基础上进行了深度优化,重点提升了模型在真实视觉任务中的表现,通过改进训练数据和后训练流程,显著增强了复杂指令遵循、图像编辑、文字布局处理以及4K高清输出等核心能力,推动AI视觉生成技术从“基础识别”向“稳定交付高质量视觉内容”迈进。

该模型采用80亿参数架构,基于NEO-unify统一框架构建,通过多专家在线策略蒸馏技术将多个专业领域的能力整合至单一模型中,实现了在消费级显卡上的流畅运行。其技术突破包括:原生支持3-4千字符的超长指令输入,解决了多数开源模型在处理长文本时易崩溃的问题;强化了主体身份保持与局部修改的精准度;优化了中英文混合排版及复杂海报设计能力;支持通过边界框定位和多图参考实现精细控制;并具备原生4K分辨率输出功能。

在实际测试中,SenseNova U1.5 Lite在创意海报设计、高密度信息图表生成、艺术风格迁移、多图融合编辑、局部内容修改及文字替换等场景中展现出高度可控性。例如,在处理包含大量文字的商业海报时,模型能准确保持品牌标识的视觉一致性,同时根据用户指令调整布局细节;在艺术创作场景中,可结合多张参考图生成风格统一的新作品,并支持对特定区域进行精细化编辑。

目前,全球开发者可通过GitHub、Hugging Face及魔搭社区获取模型代码,并在SenseNova Studio平台进行在线体验。商汤科技表示,此次开源旨在为创意工作者、开发者提供轻量化、高性价比的AI视觉工具,降低高质量视觉内容生成的技术门槛,推动AI技术在设计、广告、影视等领域的广泛应用。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version