类库 › SenseNova-Vision
OpenSenseNova

OpenSenseNova/SenseNova-Vision

SenseNova-Vision是一个统一的视觉多模态生成模型,支持图像理解与生成。它通过单一架构处理多种视觉任务,提供7B参数模型权重、50M训练数据集及推理代码,旨在简化多模态AI应用的开发与评估流程。

OpenSenseNova/SenseNova-Vision

技术栈

根目录 python

查看全部依赖 (44)

依赖

NumPy OpenEXR Pandas Pillow PyYAML Requests accelerate bitsandbytes decord einops gradio h5py huggingface_hub matplotlib ninja omegaconf open3d opencv_python openjdk 8 packaging pip 25.1 projectaria-tools protobuf psutil pyarrow pycocoevalcap pycocotools python 3.10.16 regex safetensors scipy sentencepiece setuptools 78.1.1 shapely tabulate torch torchvision tqdm transformers trimesh triton wandb wheel 0.45.1 xlsxwriter

截图

./assets/showcase/fig2_one_case_for_all.webp
./assets/fig3_system_overview.webp
./assets/showcase/fig7_sensenova_vision_results.webp
./assets/showcase/object_detection/coco_common.jpg
./assets/showcase/object_detection/LIVS.jpg
./assets/showcase/object_detection/dense200.jpg
./assets/showcase/referring_detection/141964854306.jpg
./assets/showcase/referring_detection/COCO_train2014_000000204294.jpg
./assets/showcase/ocr/textline_1.jpg
./assets/showcase/ocr/word_1.jpg
./assets/showcase/visual_prompt/2009.jpg
./assets/showcase/visual_prompt/2271.jpg
./assets/showcase/visual_prompt/2916.jpg
./assets/showcase/visual_prompt/7082.jpg
./assets/showcase/layout_grounding/layout_2.jpg
./assets/showcase/keypoints/human_1.jpg
./assets/showcase/keypoints/human_2.jpg
./assets/showcase/keypoints/animal_1.jpg

评论

ホーム - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-01 05:38
浙ICP备14020137号-1 $お客様$