.hd-box .hd-fr

商汤发布并开源 SenseNova-Vision 理解生成统一视觉大模型,能力超越 Vision Banana

2026-07-13 12:38IT之家(汪淼)19评

IT之家 7 月 13 日消息,商汤科技今日发布并全面开源日日新 SenseNova-Vision理解生成统一视觉大模型,这是商汤日日新大模型体系的重要视觉能力升级。

商汤科技表示,行业以往的 " 统一视觉 " 多是把检测、分割、深度预测等多个专家模型打包封装,本质还是割裂的。SenseNova-Vision 的核心变革是:让视觉成为通用基础模型的原生能力,彻底融入大模型体系。所有经典视觉任务如目标检测、图像分割、深度预测、3D 重建等,由此都实现了原生统一。

在多项评测中,SenseNova-Vision 以“单模型”在四大核心视觉领域大范围领跑,比肩甚至超越了各领域的专用“专家模型”:

横向对比如下:

商汤也同步开源了包含 5000 万条样本的视觉指令语料库SenseNova-Vision Corpus-50M

未来,商汤将把 SenseNova-Vision 的核心技术全面融入日日新 U 系列大模型中。

IT之家附开源地址:

https://github.com/OpenSenseNova/SenseNova-Vision

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家包含外链的文章均包含本声明。

下载IT之家APP,分享赚金币换豪礼
相关文章
大家都在买广告
热门评论
查看更多评论