商汤发布并完全开源 SenseNova-Vision-7B-MoT,一个统一处理检测、OCR、GUI、深度与法线估计、分割、多视图等主要视觉任务的模型。
该模型支持通过自然语言定义新的视觉任务变体,跨传统任务边界重组视觉能力。
开源内容包括模型权重及 SenseNova-Vision Corpus(含 5000 万示例子集及复现剩余公开数据的完整工具包)。
SenseTime hat SenseNova-Vision-7B-MoT veröffentlicht und vollständig als Open Source veröffentlicht, ein Modell zur einheitlichen Verarbeitung wichtiger vi...
SenseTime hat SenseNova-Vision-7B-MoT veröffentlicht und vollständig als Open Source veröffentlicht,
ein Modell zur einheitlichen Verarbeitung wichtiger visueller Aufgaben wie Inspektion, OCR, GUI, Tiefen- und Normalschätzung, Segmentierung und Multi-View. Das Modell unterstützt die Definition neuer visueller Aufgabenvarianten durch natürliche Sprache und reorganisiert visuelle Fähigkeiten über traditionelle Aufgabengrenzen hinweg. Die Open-Source-Inhalte umfassen Modellgewichte und SenseNova-Vision Corpus (ein vollständiges Toolkit mit einer Teilmenge von 50 Millionen Beispielen und Reproduktion der verbleibenden öffentlichen Daten).
商汤发布并完全开源 SenseNova-Vision-7B-MoT,一个统一处理检测、OCR、GUI、深度与法线估计、分割、多视图等主要视觉任务的模型。
该模型支持通过自然语言定义新的视觉任务变体,跨传统任务边界重组视觉能力。
开源内容包括模型权重及 SenseNova-Vision Corpus(含 5000 万示例子集及复现剩余公开数据的完整工具包)。
商汤发布并完全开源 SenseNova-Vision-7B-MoT。该模型统一处理检测、OCR、GUI、深度与法线估计、分割及多视图等视觉任务。
公开材料称,该模型可通过自然语言定义新的视觉任务变体,并跨传统任务边界重组视觉能力,定位于统一处理多类主要视觉任务。
Aioga 判断,其值得关注之处在于将多类视觉任务纳入同一模型,并允许以自然语言定义任务变体;实际效果仍需结合后续公开验证判断。
Aioga 判断,模型权重、语料子集及数据复现工具包的同步开放,可能为研究者开展复现、任务适配和跨任务实验提供公开基础。 值得关注后续是否出现基于公开权重与语料工具包的独立复现,以及模型在检测、OCR、GUI、分割和多视图等任务中的公开测试结果。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: x.com
Quelle: X:商汤 SenseTime (@SenseTime_AI)
原文链接: Originalquelle öffnen
Aioga 归档: 查看情报页
Content record: social-summary · Updated: 2026-07-14T00:38:32.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。