Add files using upload-large-folder tool
Browse files- .gitattributes +4 -0
- README.md +2 -4
- README_CN.md +2 -4
- assets/fig1_one_case_for_all.webp +3 -0
- assets/fig2_system_overview.webp +3 -0
- assets/fig3_training_data.png +3 -0
- assets/fig4_sensenova_vision_results.webp +3 -0
.gitattributes
CHANGED
|
@@ -33,3 +33,7 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
|
| 33 |
*.zip filter=lfs diff=lfs merge=lfs -text
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 33 |
*.zip filter=lfs diff=lfs merge=lfs -text
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
+
assets/fig1_one_case_for_all.webp filter=lfs diff=lfs merge=lfs -text
|
| 37 |
+
assets/fig2_system_overview.webp filter=lfs diff=lfs merge=lfs -text
|
| 38 |
+
assets/fig3_training_data.png filter=lfs diff=lfs merge=lfs -text
|
| 39 |
+
assets/fig4_sensenova_vision_results.webp filter=lfs diff=lfs merge=lfs -text
|
README.md
CHANGED
|
@@ -21,9 +21,7 @@ inference: false
|
|
| 21 |
|
| 22 |
<!-- Copyright 2026 SenseTime Group Inc. and/or its affiliates. -->
|
| 23 |
|
| 24 |
-
# SenseNova-Vision
|
| 25 |
-
|
| 26 |
-
**SenseNova-Vision: Rethinking Computer Vision as Unified Multimodal Generation**
|
| 27 |
|
| 28 |
<p align="center">
|
| 29 |
<strong>English</strong> | <a href="https://huggingface.co/sensenova/SenseNova-Vision-7B-MoT/blob/main/README_CN.md">简体中文</a>
|
|
@@ -31,7 +29,7 @@ inference: false
|
|
| 31 |
|
| 32 |
<p align="center">
|
| 33 |
<a href="https://github.com/OpenSenseNova/SenseNova-Vision"><img alt="GitHub Stars" src="https://img.shields.io/github/stars/OpenSenseNova/SenseNova-Vision?style=social"></a>
|
| 34 |
-
<a href="https://arxiv.org/abs/
|
| 35 |
<a href="https://huggingface.co/sensenova/SenseNova-Vision-7B-MoT"><img src="https://img.shields.io/static/v1?label=%F0%9F%A4%97%20Hugging%20Face&message=Model&color=green"></a>
|
| 36 |
<a href="https://huggingface.co/datasets/sensenova/SenseNova-Vision-Corpus-50M"><img src="https://img.shields.io/static/v1?label=%F0%9F%A4%97%20Hugging%20Face&message=Dataset&color=yellow"></a>
|
| 37 |
|
|
|
|
| 21 |
|
| 22 |
<!-- Copyright 2026 SenseTime Group Inc. and/or its affiliates. -->
|
| 23 |
|
| 24 |
+
# SenseNova-Vision: Rethinking Computer Vision as Unified Multimodal Generation**
|
|
|
|
|
|
|
| 25 |
|
| 26 |
<p align="center">
|
| 27 |
<strong>English</strong> | <a href="https://huggingface.co/sensenova/SenseNova-Vision-7B-MoT/blob/main/README_CN.md">简体中文</a>
|
|
|
|
| 29 |
|
| 30 |
<p align="center">
|
| 31 |
<a href="https://github.com/OpenSenseNova/SenseNova-Vision"><img alt="GitHub Stars" src="https://img.shields.io/github/stars/OpenSenseNova/SenseNova-Vision?style=social"></a>
|
| 32 |
+
<a href="https://arxiv.org/abs/2607.18333"><img alt="arXiv" src="https://img.shields.io/badge/arXiv-2607.18333-b31b1b.svg"></a>
|
| 33 |
<a href="https://huggingface.co/sensenova/SenseNova-Vision-7B-MoT"><img src="https://img.shields.io/static/v1?label=%F0%9F%A4%97%20Hugging%20Face&message=Model&color=green"></a>
|
| 34 |
<a href="https://huggingface.co/datasets/sensenova/SenseNova-Vision-Corpus-50M"><img src="https://img.shields.io/static/v1?label=%F0%9F%A4%97%20Hugging%20Face&message=Dataset&color=yellow"></a>
|
| 35 |
|
README_CN.md
CHANGED
|
@@ -1,7 +1,7 @@
|
|
| 1 |
---
|
| 2 |
license: cc-by-nc-4.0
|
| 3 |
language:
|
| 4 |
-
-
|
| 5 |
tags:
|
| 6 |
- multimodal
|
| 7 |
- vision-language
|
|
@@ -21,9 +21,7 @@ inference: false
|
|
| 21 |
|
| 22 |
<!-- Copyright 2026 SenseTime Group Inc. and/or its affiliates. -->
|
| 23 |
|
| 24 |
-
# SenseNova-Vision
|
| 25 |
-
|
| 26 |
-
**SenseNova-Vision: Rethinking Computer Vision as Unified Multimodal Generation**
|
| 27 |
|
| 28 |
<p align="center">
|
| 29 |
<strong>English</strong> | <a href="https://huggingface.co/sensenova/SenseNova-Vision-7B-MoT/blob/main/README_CN.md">简体中文</a>
|
|
|
|
| 1 |
---
|
| 2 |
license: cc-by-nc-4.0
|
| 3 |
language:
|
| 4 |
+
- cn
|
| 5 |
tags:
|
| 6 |
- multimodal
|
| 7 |
- vision-language
|
|
|
|
| 21 |
|
| 22 |
<!-- Copyright 2026 SenseTime Group Inc. and/or its affiliates. -->
|
| 23 |
|
| 24 |
+
# SenseNova-Vision: Rethinking Computer Vision as Unified Multimodal Generation**
|
|
|
|
|
|
|
| 25 |
|
| 26 |
<p align="center">
|
| 27 |
<strong>English</strong> | <a href="https://huggingface.co/sensenova/SenseNova-Vision-7B-MoT/blob/main/README_CN.md">简体中文</a>
|
assets/fig1_one_case_for_all.webp
ADDED
|
Git LFS Details
|
assets/fig2_system_overview.webp
ADDED
|
Git LFS Details
|
assets/fig3_training_data.png
ADDED
|
Git LFS Details
|
assets/fig4_sensenova_vision_results.webp
ADDED
|
Git LFS Details
|