DeepSeek 一体机部署-单机部署
本节介绍利用musa-deploy工具在单台服务器快速部署大模型推理服务的步骤。单机大模型推理服务是基于摩尔线程推出的vLLM-MTT产品部署的,详细的产品介绍以及部署步骤请参考vLLM-MTT页面。
阅读本章节前,建议用户先仔细阅读前面demo章节。
启动命令
用户可以通过执行以下命令快速启动:
sudo musa-deploy --demo vllm --task <model_name> [其他参数]
更多参数含义讲解,参看 demo 章节
当前支持的部分热门模型及其 Tensor Parallel 配置示例如下:
| Model | Tensor Parallel Size |
|---|---|
| deepSeek-r1-distill-qwen-1.5b | 1 |
| deepseek-r1-distill-llama-70b | 4 8 |
| deepSeek-r1-distill-qwen-32b | 2 4 |
注:
- 上表仅列举部分模型示例 ,可支持的完整模型列表参看 vllm-demo 中
--task参数讲解。
常用命令示例
1. 支持在线下载模型
如果本地没有模型,工具会自动下载模型,并存放到目录映射的宿主机目录,若无 -v 映射,会下载到容器 /musa_depeloy_xxx 目录下。
如果模型文件较大,建议用户提前下载好,通过-v映射到容器内。
sudo musa-deploy --demo vllm --task deepSeek-r1-distill-qwen-1.5B -v /data/mtt:/data/mtt