大模型

商汤开源U1.5-Lite轻量多模态模型:8B-MoE参数,原生支持4K图像生成与编辑

发布时间:2026年08月04日 11:00:00

8月4日,商汤科技正式开源SenseNova U1.5-Lite-Preview轻量统一多模态模型,基于前代U1架构全面迭代。以仅8B-MoE的轻量化参数规模,实现4K高清图像生成、精细化视觉编辑、精准文字排版等高阶能力。Qwen-Image-Bench得分从47.14提升至55.20,多项权威基准测试大幅跃升。


发布概况

8月4日,商汤科技正式开源SenseNova U1.5-Lite-Preview轻量统一多模态模型。该模型摒弃盲目扩大参数的迭代思路,通过全链路技术优化实现能力突破,以仅8B-MoE的轻量化参数规模实现高阶多模态能力。

模型规格

  • 参数量:8B(MoE架构)
  • 架构:基于前代U1架构全面迭代
  • 许可证:开源
  • 定位:轻量化统一多模态模型,适配设计创作、电商美工、视觉修图等场景

核心能力

四大核心能力全面升级

与旧版模型相比,U1.5-Lite在以下方面实现显著提升:

  • 4K超高清生成:原生支持4K分辨率,优化画面纹理质感与真实度
  • 精准文字排版:精准实现中英文文字生成和复杂版式排版
  • 图像编辑稳定性:修改画面时可完好保留原图主体、结构与未改动区域
  • 指令遵循精度:大幅提升对用户指令的理解和执行精度

基准测试成绩

多项权威基准测试成绩大幅跃升:

  • Qwen-Image-Bench:从47.14提升至55.20
  • 多平台图像编辑评测:分数均显著上涨

技术架构

架构创新

技术团队在以下方面进行了关键创新:

  • 重构生成头结构:解决高分辨率图像网格伪影问题
  • 优化训练数据集:提高训练数据的质量和多样性
  • 任务逻辑优化:提升多模态任务的执行效率
  • 全链路技术优化:通过架构创新而非参数堆叠实现能力突破

行业影响

轻量化多模态模型的新方向

U1.5-Lite代表了一种"小参数、大能力"的新思路:

  • 以8B参数实现原本需要更大模型才能完成的4K生成任务
  • 降低了多模态模型部署的硬件门槛
  • 为端侧AI和轻量化商用场景提供了可行方案

开源生态

商汤选择开源U1.5-Lite,将进一步推动多模态AI技术的普及:

  • 开发者可基于此进行二次开发
  • 适配设计创作、电商美工、视觉修图等轻量化商用场景
  • 助力降低行业AI视觉创作门槛

后续观察

模型在社区中的采用率、与竞品(如Stable Diffusion、Midjourney)的对比表现、以及商汤后续在更大规模多模态模型上的布局,将是关键观察点。