服务配置
以下操作均在摩影元像端执行。
使用已配置好的本地大 模型
双盒子方案有默认本地大模型。该模型服务在大模型端运行,使用前需要确保模型和推理环境已部署完成,且摩影元像端与大模型端的有线网络连接正常。
配置自定义大模型
打开摩影元像,点击右下角 设置 -> 切换模型 -> 添加模型,在对话框中输入自定义大模型的连接参数。
参数说明:
- 模型名称:自定义名称。
- 模型:
chat_completions请求 body 中的model参数。本地 vLLM 服务可填写启动命令vllm serve后面的模型字符串,例如/opt/mt-ai/llm/gptq-Qwen3-8B/,请按实际模型路径替换。 - endpoint:
chat_completions接口的完整地址。本地双盒子方案示例为http://192.168.100.2:8000/v1/chat/completions。 - token:
bearer token,请勿填入bearer前缀。本地模型可填写任意值。

点击保存后,点击刷新状态,状态为正常说明模型服务正常。

选中刚刚添加的模型,即可使用该模型进行对话。
配置固定问答
方法一:手动添加
点击 切换模型 -> 固定问答 -> 添加,输入问答名称、问题和答案后点击保存。

方法二:上传 JSON 文件
点击 切换模型 -> 固定问答 -> 上传,选择要使用的 JSON 文件,上传后点击确定。JSON 文件格式如下:
{
"faq": [
{
"q": "什么是FAQ?",
"a": "FAQ是“常见问题解答”,用来集中回答用户最常提出的问题。"
},
{
"q": "什么是数字人?",
"a": "数字人是利用计算机图形学、人工智能等技术创建的高度拟人化的虚拟形象。它不仅能进行表情、语言和动作的交互,甚至拥有独特的“人格”,可用于替代或辅助真人完成多种任务。"
},
{
"q": "数字人和普通的虚拟形象(比如游戏角色)有什么区别?",
"a": "核心区别在于“交互性”和“智能性”。游戏角色通常由脚本预设,而数字人由AI驱动,能够实时感知、理解并回应人类的语言和情感,进行更自然、更智能的对话。"
}
]
}
配置知识库
点击 切换模型 -> 知识库 -> 创建,输入知识库名称后点击创建。点击知识库右侧的编辑按钮,上传知识库文件。
当前支持上传 txt、md、pdf、doc、docx、xls、xlsx 格式文件。
