---
title: Sensenova-Vision
canonical_url: "https://www.modelscope.ai/studios/zheng.Jing/Sensenova-Vision"
md_url: "https://www.modelscope.ai/studios/zheng.Jing/Sensenova-Vision.md"
repository: zheng.Jing/Sensenova-Vision
last_updated: 2026-07-29
sdk_type: gradio
sdk_version: 5.42.0
downloads: 0
stars: 7
---

# Sensenova-Vision

> Sensenova-Vision - An interactive demo by zheng.Jing on ModelScope. SenseNova-Vision 统一多模态视觉生成模型 SenseNova-Vision-7B-MoT 的本地推理 Gradio 演示。 本创空间在 NVIDIA xGPU (48G) 上本地加载模型权重并推理（不依赖任何远程 API 推理服务）。首次启动时会自动从 ModelScope 下载模型权重。 支持的任务 开放理解 / 图像描述（文本输出） 目标检测 / 点检测 /…

zheng.Jing/Sensenova-Vision is an interactive demo (Studio) on ModelScope. built with gradio 5.42.0.

- **Repository**: zheng.Jing/Sensenova-Vision
- **SDK**: gradio
- **SDK version**: 5.42.0
- **Downloads**: 0
- **Stars**: 7
- **Last updated**: 2026-07-29

Source: https://www.modelscope.ai/studios/zheng.Jing/Sensenova-Vision

---

# SenseNova-Vision

统一多模态视觉生成模型 [SenseNova-Vision-7B-MoT](https://modelscope.cn/models/SenseNova/SenseNova-Vision-7B-MoT) 的本地推理 Gradio 演示。

本创空间在 **NVIDIA xGPU (48G)** 上**本地加载模型权重并推理**（不依赖任何远程 API 推理服务）。首次启动时会自动从 ModelScope 下载模型权重。

## 支持的任务

- 开放理解 / 图像描述（文本输出）
- 目标检测 / 点检测 / 关键点检测（结构化文本）
- word 级 OCR（文本 + 坐标）
- 相对深度估计 / 表面法线估计（稠密图像）
- 二值分割 / 全景分割 / GCG 分割（掩码 / 文本+掩码）
- 多视角 3D 重建（点云 + GLB）/ 相机位姿估计

## 运行方式

- 入口文件：`app.py`
- 模型来源：ModelScope `SenseNova/SenseNova-Vision-7B-MoT`（首次运行自动下载）
- 推理精度：bf16

## 致谢

模型与官方推理代码来自 [OpenSenseNova/SenseNova-Vision](https://github.com/OpenSenseNova/SenseNova-Vision)。模型权重遵循 CC BY-NC 4.0 许可，仅供非商业用途。
