AI++
模型约 2 分钟读完github.com

商汤开源 SenseNova U1.5-Lite-Preview:8B-MoT 原生统一多模态,支持 4K 生成

发生了什么:商汤科技开源轻量级原生统一多模态模型 SenseNova U1.5-Lite-Preview,基于今年 4 月发布的 U1 与 NEO-Unify 架构做系统性迭代,在单一模型中贯通视觉理解、推理、生成与编辑。以 8B-MoT 规模原生支持 4K 图像生成,重新设计生成头以削弱视觉 Token 网格伪影,并采用 encoder-free 视觉建模保留笔画与纹理细节;编辑侧强化了对原图主体身份与非编辑区域的保持。官方自报评测:Qwen-Image-Bench 由 47.14 提升至 55.20(with Prompt Enhance),ImgEdit-Bench 3.90→4.37,GEdit-Bench-en 7.47→8.17、GEdit-Bench-zh 7.42→8.05。已上架 GitHub、Hugging Face 与魔搭社区。为什么重要:验证了原生统一架构不只是「能同时做理解和生成」,还能在不堆参数的前提下扩展到更高分辨率与可持续迭代编辑,把图像创作从一次性抽卡变成反复改。分数均为商汤自报口径。

快速要点

AI++ 提炼
  1. 发生了什么:商汤科技开源轻量级原生统一多模态模型 SenseNova U1.5-Lite-Preview,基于今年 4 月发布的 U1 与 NEO-Unify 架构做系统性迭代,在单一模型中贯通视觉理解、推理、生成与编辑
  2. 以 8B-MoT 规模原生支持 4K 图像生成,重新设计生成头以削弱视觉 Token 网格伪影,并采用 encoder-free 视觉建模保留笔画与纹理细节
  3. 编辑侧强化了对原图主体身份与非编辑区域的保持
  4. 官方自报评测:Qwen-Image-Bench 由 47.14 提升至 55.20(with Prompt Enhance),ImgEdit-Bench 3.90→4.37,GEdit-Bench-en 7.47→8.17、GEdit-Bench-zh 7.42→8.05

内容详述

发生了什么:商汤科技开源轻量级原生统一多模态模型 SenseNova U1.5-Lite-Preview,基于今年 4 月发布的 U1 与 NEO-Unify 架构做系统性迭代,在单一模型中贯通视觉理解、推理、生成与编辑。以 8B-MoT 规模原生支持 4K 图像生成,重新设计生成头以削弱视觉 Token 网格伪影,并采用 encoder-free 视觉建模保留笔画与纹理细节;编辑侧强化了对原图主体身份与非编辑区域的保持。官方自报评测:Qwen-Image-Bench 由 47.14 提升至 55.20(with Prompt Enhance),ImgEdit-Bench 3.90→4.37,GEdit-Bench-en 7.47→8.17、GEdit-Bench-zh 7.42→8.05。

已上架 GitHub、Hugging Face 与魔搭社区。为什么重要:验证了原生统一架构不只是「能同时做理解和生成」,还能在不堆参数的前提下扩展到更高分辨率与可持续迭代编辑,把图像创作从一次性抽卡变成反复改。分数均为商汤自报口径。

G
打开原文