MTGPU Model Zoo
简介
本项目仓库链接:https://gitee.com/MooreThreads-AI-SOC/m1000_gpu_model_zoo
本项目旨在演示如何利用 MTGPU 和 torch_musa 进行模型推理加速,帮助开发者在 MTGPU 上快速上手开发和落地各种 AI 模型推理服务。
模型支持
如果开发者有新的模型适配,欢迎提交 PR!
图像分类 Image Classification
| 模型 | 框架 | 状态 | 链接 | 描述 |
|---|---|---|---|---|
| VIT | PyTorch | ✅ | 🔗 | Google Vision Transformer |
| NSFW | PyTorch | ✅ | 🔗 | NSFW 图像检测(基于 ViT) |
| Gender Classification | PyTorch | ✅ | 🔗 | 性别分类(基于 ViT) |
| SWIN | PyTorch | ✅ | 🔗 | 分类 / 特征骨干网络(ViT) |
| EfficientNet | PyTorch | ✅ | 🔗 | 轻量纯卷积模型(ConvNet) |
| DINO | PyTorch | ✅ | 🔗 | 基于 DINOv2 训练的 ViT |
| CLIP | PyTorch | ✅ | 🔗 | OpenAI CLIP 模型 |
| Chinese-CLIP-ViT | PyTorch | ✅ | 🔗 | 中文 CLIP 模型 |
| AlexNet | ONNX | ✅ | 🔗 | ImageNet 分类 |
| LeNet | ONNX | ✅ | 🔗 | 图像分类 |
| MobileNet-V1 | PyTorch | ✅ | 🔗 | 边缘设备分类、检测、嵌入和分割模型 |
| MobileNet-V3 | PyTorch | ✅ | 🔗 | MobileNet V3 |
| VGG | PyTorch | ✅ | 🔗 | 图像分类 / 特征骨干网络 |
目标检测 Object Detection
| 模型 | 框架 | 状态 | 链接 | 描述 |
|---|---|---|---|---|
| yolov5 | PyTorch | ✅ | 🔗 | Ultralytics YOLO 目标检测 |
| yolov8 | PyTorch | ✅ | 🔗 | Ultralytics YOLO 目标检测 |
| yolov10 | PyTorch | ✅ | 🔗 | Ultralytics YOLO 目标检测 |
| yolov11 | PyTorch | ✅ | 🔗 | Ultralytics YOLO 目标检测 |
| ADAFACE | PyTorch | ✅ | 🔗 | 人脸识别 CV 模型 |
| EfficientDet-D0 | PyTorch | ✅ | 🔗 | 可扩展的高效目标检测 |
| FasterRCNN | ONNX | 🚧 | 🔗 | 实时目标检测 |
| RetinaFace | PyTorch | ✅ | 🔗 | 单阶段密集人脸定位 |
| SSD MobileNet-V2 | ONNX | ✅ | 🔗 | 现代卷积目标检测速度与精度权衡方案 |
| DETR ResNet50 | PyTorch | ✅ | 🔗 | 基于卷积骨干的编码器-解码器 Transformer |
分割模型 Segment Models
| 模型 | 框架 | 状态 | 链接 | 描述 |
|---|---|---|---|---|
| SAM2 | PyTorch | ✅ | 🔗 | Segment Anything Model (Transformer) |
| DeepLabV3+ | PyTorch | ✅ | 🔗 | 基于 MobileNetV2 的 DeepLabV3+ |
| FastSAM | ONNX | ✅ | 🔗 | 快速 Segment Anything Model |
其它模型 Other Models
| 模型 | 框架 | 状态 | 链接 | 描述 |
|---|---|---|---|---|
| MediaPipe-Hand | ONNX | ✅ | 🔗 | 实时手部检测 |
| PP-OCRv5 | PaddlePaddle | ✅ | 🔗 | PaddleOCR 团队文本检测模型 |
| Unet-Segment | ONNX | ✅ | 🔗 | 实时分割 |
| SuperPoint | PyTorch | ✅ | 🔗 | 兴趣点检测与描述 |
| Mask2Former | PyTorch | ✅ | 🔗 | 通用图像分割 Mask Transformer |
| Cutie | PyTorch | 🚧 | 🔗 | 视频目标分割 |
| GTE Base | PyTorch | 🚧 | 🔗 | GTE 多语言通用文本表示模型 |
| InsightFace | ONNX | ✅ | 🔗 | 人脸分析 |
| Whisper | PyTorch | 🚧 | 🔗 | 自动语音识别(ASR)与语音翻译 |
| Zipformer | ONNX | 🚧 | 🔗 | k2-zipformer-streaming 中英语音识别模型 |
| Wespeaker | ONNX | ✅ | 🔗 | 说话人嵌入学习与验证 |
问题与反馈
如果 在开发或者使用 mtgpu_model_zoo 的过程中,遇到任何 bug 或者未支持的特性,请向仓库提交 issue。提交 issue 时,请给出复现问题的代码、报错 log,并打上对应标签。

