商汤科技宣布开源轻量级统一多模态模型预览版 SenseNova U1.5-Lite-Preview。该模型作为 SenseNova U1 的系统性迭代版本,基于 NEO-unify架构,在仅8B-MoT参数规模下,实现原生4K图像生成、更细致纹理表现、更精准的中英文文字生成以及更稳定的图像编辑能力。

据介绍,SenseNova U1.5-Lite-Preview重点提升了模型对长篇自然语言描述和结构化视觉指令的理解能力,能够根据复杂需求实现更精准的视觉控制。在图像编辑方面,新模型支持参考图风格迁移、多参考图组合编辑以及交互式精准调整,使AI图像创作从一次性生成转向持续迭代优化。
相比上一代模型,U1.5-Lite-Preview在多项评测基准中取得提升。商汤表示,该模型能够在较小模型规模下兼顾生成质量和交互能力,进一步降低多模态AI技术应用门槛。
目前,SenseNova U1.5-Lite-Preview 已在 GitHub、Hugging Face 以及魔搭社区开放下载,开发者和研究者可基于该模型进行二次开发。同时,面向专业创作者和企业用户的交付级创作模型 SenseNova U1Pro 正处于紧密邀测阶段。
随着多模态模型竞争逐渐从参数规模转向效率、控制能力和实际应用体验,商汤此次开源轻量化模型,也体现了行业推动高性能AI能力向更广泛开发者生态开放的趋势。