商汤发布并完全开源 SenseNova-Vision-7B-MoT,一个统一处理检测、OCR、GUI、深度与法线估计、分割、多视图等主要视觉任务的模型。
该模型支持通过自然语言定义新的视觉任务变体,跨传统任务边界重组视觉能力。
开源内容包括模型权重及 SenseNova-Vision Corpus(含 5000 万示例子集及复现剩余公开数据的完整工具包)。
SenseTime은 검사, OCR, GUI, 깊이 및 정규 추정, 분할, 다중 뷰 등 주요 시각 작업을 통합적으로 처리하는 모델을 출시하여 완전 오픈소스로 출시했습니다. 이 모델은 자연어를 통해 새로운 시각적 과제 변형을 정의하고, 전통적인 과제 경계를 넘어 시각적 능력을 재조...
SenseTime은 검사, OCR, GUI, 깊이 및 정규 추정, 분할, 다중 뷰 등 주요 시각 작업을 통합적으로 처리하는 모델을 출시하여 완전 오픈소스로 출시했습니다. 이 모델은
자연어를 통해 새로운 시각적 과제 변형을 정의하고, 전통적인 과제 경계를 넘어 시각적 능력을 재조직하는 것을 지원합니다. 오픈 소스 콘텐츠에는 모델 가중치와 SenseNova-Vision 코퍼스(5천만 개의 예제 하위 집합과 남은 공개 데이터의 복제가 포함된 완전한 툴킷)가 포함되어 있습니다.
商汤发布并完全开源 SenseNova-Vision-7B-MoT,一个统一处理检测、OCR、GUI、深度与法线估计、分割、多视图等主要视觉任务的模型。
该模型支持通过自然语言定义新的视觉任务变体,跨传统任务边界重组视觉能力。
开源内容包括模型权重及 SenseNova-Vision Corpus(含 5000 万示例子集及复现剩余公开数据的完整工具包)。
商汤发布并完全开源 SenseNova-Vision-7B-MoT。该模型统一处理检测、OCR、GUI、深度与法线估计、分割及多视图等视觉任务。
公开材料称,该模型可通过自然语言定义新的视觉任务变体,并跨传统任务边界重组视觉能力,定位于统一处理多类主要视觉任务。
Aioga 判断,其值得关注之处在于将多类视觉任务纳入同一模型,并允许以自然语言定义任务变体;实际效果仍需结合后续公开验证判断。
Aioga 判断,模型权重、语料子集及数据复现工具包的同步开放,可能为研究者开展复现、任务适配和跨任务实验提供公开基础。 值得关注后续是否出现基于公开权重与语料工具包的独立复现,以及模型在检测、OCR、GUI、分割和多视图等任务中的公开测试结果。
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.
수집 채널: 요약 집계 · 원본 도메인: x.com
출처: X:商汤 SenseTime (@SenseTime_AI)
원문 링크: 원문 열기
Aioga 아카이브: 정보 페이지 보기
Content record: social-summary · Updated: 2026-07-14T00:38:32.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga는 전 세계 AI 동향을 집계하고 확인과 인용을 위해 출처 정보를 보존합니다.