商汤 SenseNova U1.5 Lite 正式开源:轻量级多模态模型,强化视觉理解
8 月 21 日,商汤科技正式开源 SenseNova U1.5 Lite——一款轻量级、原生统一多模态大模型。该版本重点围绕真实视觉任务重新完善训练数据与后训练流程,在视觉质量、复杂指令遵循、文字与布局、原生 4K 分辨率等方面做了针对性强化。
核心特性
- 原生多模态:统一架构处理文本与图像输入,不是拼接两个独立模型
- 视觉质量强化:重新设计了视觉任务的数据和训练流程,针对真实场景优化
- 复杂指令遵循:提升了多步骤、多约束条件下的指令理解和执行准确率
- 文字与布局:在图像中的文字识别和版面理解能力增强
- 原生 4K 分辨率:支持高分辨率图像输入,不靠切图拼凑
- 开源轻量级:适合本地部署和二次开发
适合谁用
作为开源轻量模型,SenseNova U1.5 Lite 主要面向:
- 需要在本地部署多模态模型的企业团队(私有数据不出域)
- 做视觉理解应用的开发者(文档分析、图表理解、OCR 增强等)
- 研究多模态模型训练方法的学术团队
怎么看
2026 年多模态模型赛道竞争焦点已经从「能做」转向「做得准」。SenseNova U1.5 Lite 不追参数量,而是在视觉理解的真实场景准确率上做文章——这是务实的选择。轻量级+开源的定位也降低了使用门槛,适合想要私有部署又不想要超大模型的团队。
商汤的 SenseNova 系列已覆盖从超大模型到轻量级的全尺寸布局,U1.5 Lite 填补了「视觉优先+可本地部署」这个位置。后续我们会持续追踪商汤模型更新,欢迎收藏 AI智库。
©️版权声明:若无特殊声明,本站所有文章版权均归AI智库原创和所有,未经许可,任何个人、媒体、网站、团体不得转载、抄袭或以其他方式复制发表本站内容,或在非我站所属的服务器上建立镜像。否则,我站将依法保留追究相关法律责任的权利。
辽公网安备21021102001760号