【中级】部署 Dify 本地知识库
更新日志
| 版本 | 日期 | 变更描述 |
|---|---|---|
| 1.0.0 | 2026-03-04 | 初始版本,包含在 AI 算力本 MTT AIBOOK(型号 A141)上安装和配置构建本地知识库环境依赖,以及配置本地知识库的完整指南 |
| 1.0.1 | 2026-08-10 | 更新对 vLLM 环境部署的相关描述。 |
1. 项目简介
本教程旨在指导开发者在 AI 算力本 MTT AIBOOK 上基于 Dify 和本地大模型搭建自己的本地个人知识库。您可以基于本项目的内容,学会把自己的个人资料、过往输出文章、日记等所有个人信息上传到本地知识库,打造自己的私人助理。
本项目将按照以下主线展开:
- 安装 docker
- 安装 docker-compose
- 部署 Ollama
- 部署 vLLM
- 部署 Dify
- 创建 Dify 应用
- 创建 Dify 知识库
- 将本地模型接入 Dify 工作流
并最终结合最佳实践,带您快速上手完成本地个人知识库的搭建。
docker 简介: Docker 为 Dify 提供了一键式的容器化部署方案。它将 Dify 及其所需的数据库、中间件等组件完整打包,确保应用在不同服务器上都能实现"开箱即用"的一致性体验。
Ollama 简介: Ollama 是一个用于在本地设备上运行大语言模型的工具,可以一键下载并运行如 Llama、Qwen、Mistral 等模型。它让本地部署 AI 变得非常简单,适合个人开发者或企业在本地环境运行 AI。值得注意的是,当前在 MTT AIBOOK 上,Ollama 暂未支持 GPU 加速,只能使用 CPU 推理。本文档将基于 Ollama 运行文本向量化模型。
vLLM 简介: vLLM 是一个高性能的大模型推理框架,专门用于部署和服务大语言模型。它通过 PagedAttention 等优化技术显著提升推理吞吐量和显存利用率,当前在 MTT AIBOOK 已支持基于 vLLM 对推理过程进行 GPU 加速。本文档将基于 vLLM 运行大语言模型。
Dify 简介: Dify 是一个开源的 AI 应用开发平台,可以通过可视化方式快速构建 AI 助手、RAG 知识库、AI 工作流等应用。它支持接入多种大模型,并提供完整的应用管理和数据管理能力。
难度:中级,适合有编程基础的开发者体验
2. 前置条件
在开始本教程之前,请确保您已满足以下所有条件:
- 硬件要求:
- AI 算力本 MTT AIBOOK,型号 A141
- 网络连接(用于拉取 docker 镜像、下载模型及依赖包)
- 充足的存储空间
- 软件要求:
- MTT AIBOOK 操作系统 AIOS(1.3.3-B17)及以上版本(文档基于 1.3.3-B17 版本系统操作,并非强制性要求必须 1.3.3-B17 及以上版本)
- 已安装 docker-compose(可通过本教程中的步骤进行安装)
- 已安装 Ollama(可通过本教程中的步骤进行安装)
3. 环境部署
本章节将详细描述如何创建工作目录、安装 docker、安装 docker-compose、通过 Ollama 拉取向量模型并推理、通过 vLLM 基于 GPU 加速推理大模型、部署 Dify、创建 Dify 应用、创建 Dify 知识库并最终将本地模型接入 Dify 工作流。
3.1 创建工作目录
创建一个专门用于本地知识库搭建的工作目录,有助于您更好地管理相关文件和资源。
执行以下命令即可完成工作目录的创建:
mkdir ~/local-know-base && cd ~/local-know-base
3.2 安装 docker
若您的设备已安装过 docker,可跳过此步骤。
执行以下命令即可完成 docker 的安装:
sudo apt update
sudo apt-get install \
docker.io=24.0.7-0ubuntu2~22.04.1 \
containerd=1.7.2-0ubuntu1~22.04.1
执行完以下命令后,需要重启设备生效:
sudo usermod -aG docker $USER
以上操作全部执行完毕后,可以执行以下命令验证 docker 是否成功安装:
docker --version
![]()
3.3 安装 docker-compose
docker-compose 是一个用于定义和运行多容器 Docker 应用程序的工具,它可以帮助我们更方便地管理 Dify 的容器化部署。
sudo curl -L "https://github.com/docker/compose/releases/download/v2.24.6/docker-compose-linux-aarch64" -o /usr/local/bin/docker-compose
sudo chmod +x /usr/local/bin/docker-compose
3.4 安装 Ollama
sudo apt install curl
curl -fsSL https://ollama.com/install.sh | OLLAMA_VERSION=0.15.1 sh
安装完成后,打开终端,输入以下命令确认版本:
ollama --version
如果输出为 ollama version is 0.15.1,说明安装成功。
3.5 拉取向量模型 nomic-embed-text
向量模型 nomic-embed-text 用于将文档内容转换为向量表示,以便进行语义搜索和相似度计算。拉取该模型是构建本地知识库的必要步骤。
ollama pull nomic-embed-text
3.6 部署 vLLM
本文档将基于 vLLM 进行本地大模型的推理,因此需要安装部署 vLLM 及其相关依赖的环境,在确认 MTT AIBOOK 的系统版本后,根据以下链接的网页跳转到对应系统版本的安装部署指导文档,部署正确的 vLLM 及其环境依赖:
https://docs.mthreads.com/vllm-musa-m1000/vllm-musa-m1000-doc-online/AIBook/
根据文档指引部署成功后,即可进行下一步。
注意:AIOS 1.5.0 及以上版本,相关的 vLLM 及 vLLM 依赖环境将由系统自动更新,而无需用户手动更新。
3.7 部署 Dify
首先,克隆 Dify 官方开源仓库到工作目录:
cd ~/local-know-base
git clone https://github.com/langgenius/dify.git
Dify 使用 .env 文件管理配置。我们通过复制示例文件来创建它:
cd ~/local-know-base/dify/docker
cp .env.example .env
由于我们只是将 Dify 运行在本地,因此无需修改 .env 文件的任何内容。
随后,我们使用 docker-compose 在后台启动 .env 文件中记录的所有相关服务(包括数据库、向量数据库、API 和 Web 前端):
docker-compose up -d
注:此步骤会从 Docker Hub 拉取多个镜像,耗时取决于网络带宽。

镜像拉取结束后,打开浏览器,输入网址:http://localhost
即可进入本地部署的 Dify 界面,首次进入页面,系统会提示您设置管理员邮箱、用户名和密码。

注册成功后,登录管理员账户,进入 Dify 主界面,如下所示:
