跳到主要内容

支持模型列表

llama.cpp-musa 当前主要针对 Q4_K 量化类型进行性能优化,推荐优先选择 Q4_K 格式模型。除 MUSA 相关运行参数外,模型启动和推理使用方式尽量与原生 llama.cpp 保持兼容。

模型类别模型名称模型链接
Qwen3.5Qwen3.5-9B-Q4_K.ggufhttps://www.modelscope.cn/models/zenbit/Qwen3.5-9B-Q4_K-GGUF
Qwen3.6Qwen3.6-35B-A3B-Q4_K.ggufhttps://www.modelscope.cn/models/zenbit/Qwen3.6-35B-A3B-Q4_K-GGUF
Qwen3.6 ViTmmproj-Qwen3.6-35B-A3B-BF16.ggufhttps://www.modelscope.cn/models/zenbit/mmproj-Qwen3.6-35B-A3B-BF16-GGUF
Qwen3.5Qwen3.5-4B-Q4_Khttps://www.modelscope.cn/zenbit/Qwen3.5-4B-Q4_K_PURE
EmbeddingQwen3-Embedding-0.6B-f16.ggufhttps://modelscope.cn/models/zenbit/Qwen3-Embedding-0.6B-f16

mmproj-Qwen3.6-35B-A3B-BF16.ggufQwen3.6-35B-A3B-Q4_K.gguf 开启多模态时需指定的 ViT 模型。