热门搜索:和平精英 原神 街篮2 

您的位置:首页 > > 教程攻略 > ai资讯 >商汤开源视觉模型

商汤开源视觉模型

来源:互联网 更新时间:2026-07-20 12:41

视觉领域最近又有大动作。商汤科技正式开源了一款多任务视觉模型——SenseNova-Vision-7B-MoT,目标很明确:给视觉理解和GUI智能体开发提供一套更扎实的底座。

这款模型最吸睛的地方,在于它把多个核心视觉任务一口气整合到了同一个7B参数规模的框架里。目标检测、OCR、深度估计、法线估计、图像分割,甚至多视图处理——这些原本各自为战的能力,现在被统一集成。更关键的是,它还支持通过自然语言来定义全新的视觉任务变体,这意味着视觉能力的边界不再被传统任务分类所束缚,可以进行灵活重组。

image.png

商汤这次的开源策略相当彻底。开发者不仅能拿到模型权重,还能获得一个包含5000万个样本的SenseNova-Vision语料库子集,外加一套完整的复现工具包——后者专门用来处理剩余的公开数据。对于社区的研究和应用落地来说,这无疑是一份厚礼。

业内专家评价说,SenseNova-Vision-7B-MoT的发布,并不是简单的轻量化模型迭代,而是一个更具扩展性的统一框架。目前,模型的技术细节、代码仓库和演示空间已经在Hugging Face和GitHub上上线,科研人员和开发者可以直接调用,加速技术创新和落地。

项目地址:https://github.com/OpenSenseNova/SenseNova-Vision

热门手游

相关攻略

手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc