大模型
商汤开源U1.5-Lite轻量多模态模型:8B-MoE参数,原生支持4K图像生成与编辑
发布时间:2026年08月04日 11:00:008月4日,商汤科技正式开源SenseNova U1.5-Lite-Preview轻量统一多模态模型,基于前代U1架构全面迭代。以仅8B-MoE的轻量化参数规模,实现4K高清图像生成、精细化视觉编辑、精准文字排版等高阶能力。Qwen-Image-Bench得分从47.14提升至55.20,多项权威基准测试大幅跃升。
发布概况
8月4日,商汤科技正式开源SenseNova U1.5-Lite-Preview轻量统一多模态模型。该模型摒弃盲目扩大参数的迭代思路,通过全链路技术优化实现能力突破,以仅8B-MoE的轻量化参数规模实现高阶多模态能力。
模型规格
- 参数量:8B(MoE架构)
- 架构:基于前代U1架构全面迭代
- 许可证:开源
- 定位:轻量化统一多模态模型,适配设计创作、电商美工、视觉修图等场景
核心能力
四大核心能力全面升级
与旧版模型相比,U1.5-Lite在以下方面实现显著提升:
- 4K超高清生成:原生支持4K分辨率,优化画面纹理质感与真实度
- 精准文字排版:精准实现中英文文字生成和复杂版式排版
- 图像编辑稳定性:修改画面时可完好保留原图主体、结构与未改动区域
- 指令遵循精度:大幅提升对用户指令的理解和执行精度
基准测试成绩
多项权威基准测试成绩大幅跃升:
- Qwen-Image-Bench:从47.14提升至55.20
- 多平台图像编辑评测:分数均显著上涨
技术架构
架构创新
技术团队在以下方面进行了关键创新:
- 重构生成头结构:解决高分辨率图像网格伪影问题
- 优化训练数据集:提高训练数据的质量和多样性
- 任务逻辑优化:提升多模态任务的执行效率
- 全链路技术优化:通过架构创新而非参数堆叠实现能力突破
行业影响
轻量化多模态模型的新方向
U1.5-Lite代表了一种"小参数、大能力"的新思路:
- 以8B参数实现原本需要更大模型才能完成的4K生成任务
- 降低了多模态模型部署的硬件门槛
- 为端侧AI和轻量化商用场景提供了可行方案
开源生态
商汤选择开源U1.5-Lite,将进一步推动多模态AI技术的普及:
- 开发者可基于此进行二次开发
- 适配设计创作、电商美工、视觉修图等轻量化商用场景
- 助力降低行业AI视觉创作门槛
后续观察
模型在社区中的采用率、与竞品(如Stable Diffusion、Midjourney)的对比表现、以及商汤后续在更大规模多模态模型上的布局,将是关键观察点。