原生支持 4K 图像输出,商汤开源 8B 参数量多模态大模型 SenseNova U1.5 Lite
2 小时前 / 阅读约2分钟
来源:IT之家
商汤科技宣布开源轻量级多模态大模型SenseNova U1.5 Lite,支持3-4k上下文长度,提升复杂视觉任务稳定性,具备高质量视觉生成、可靠图像编辑、精细视觉控制等特点。

IT之家 8 月 21 日消息,商汤科技今日宣布开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite。

据介绍,SenseNova U1.5 Lite 原生支持 3-4k 上下文长度,能够同时处理主体、数量、空间关系、文字、布局、风格等多重约束,提升复杂视觉任务的执行稳定性。

此外,SenseNova U1.5 Lite 还有以下特点:

  • 更高质量的视觉生成:改善整体构图、色彩、材质、光影、真实感和局部细节,减少“局部正确但整体完成度不足”的情况。

  • 更可靠的原生图像编辑:增强主体身份、空间结构、版式关系和非编辑区域的保持,同时提升局部修改、元素替换、文字精修和多参考图编辑能力。

  • 更好的文字与复杂布局:加强中英文文字、海报、信息图、品牌视觉及多文本排版能力,从“生成内容”进一步走向“组织完整视觉表达”。

  • 更精细的视觉控制:支持 Bounding Box、Visual Marker 以及单图、多图参考等方式,对指定区域和对象进行更准确的编辑。

  • 原生 4K 高分辨率输出:在高分辨率生成中兼顾整体构图与极精细的肌理、微小文字与光影折射。

官方表示,作为 8B 参数的轻量化模型,SenseNova U1.5 Lite 在指令遵循与图像编辑保持度上超越了同量级模型,并在文字渲染与复杂布局上达到了媲美超大规模商业模型的交付水平。

IT之家附开源链接:

  • GitHub:https://github.com/OpenSenseNova/SenseNova-U1

  • Hugging Face:https://huggingface.co/collections/sensenova/sensenova-u15

  • 魔搭社区:https://modelscope.cn/models/SenseNova/SenseNova-U1.5-8B-MoT