产品介绍
本章节介绍 Linux 服务器驱动文档覆盖的 MTT S5000 与 MTT S4000 两款产品,包括产品定位、关键能力和典型应用场景。环境兼容性与安装方法,参见发布版本信息和安装指南。
MTT S5000
产品定位
MTT S5000 是面向生成式 AI 训练、推理和高性能计算的训推一体全功能 GPU 智算卡,基于第四代 MUSA 全栈平台,核心搭载 PH100 芯片。
主要特性
- 单卡 AI 稠密算力最高可达
1000 TFLOPS,满足大模型训练和推理的高算力需求。 - 支持从
FP8到FP64的全精度算力,适用于大模型训 练、微调和推理。 - 单卡提供
80 GB显存和1.6 TB/s显存带宽,可满足大参数模型和高吞吐任务的数据访问需求。 - 支持
MTLink8 卡全互联,卡间互联带宽可达784 GB/s,便于构建大规模训练和推理集群。 - 提供风冷和液冷形态,可覆盖数据中心不同部署方案。
- 原生适配
PyTorch、Megatron-LM、vLLM、SGLang等主流框架,便于将现有代码迁移到 MUSA 平台。
典型应用场景
- 大语言模型训练与微调
- 高并发、低时延在线推理
- 高性能计算
- 多媒体处理与安全计算
MTT S4000
产品定位
MTT S4000 是面向大模型训练、微调和推理的智算加速卡,采用第三代 MUSA 架构,兼顾 AI 计算、图形渲染、多媒体处理和超高清显示能力。
主要特性
- 配备 Tensor 核心,支持
FP64、FP32、TF32、FP16、BF16、INT8等主流精度。 - 单卡提供
48 GB显存和768 GB/s显存带宽,适合中大规模模型训练、微调和推理任务。 - 支持基于
MTLink的多卡互联,便于扩展多卡和集群部署。 - 提供图形渲染、视频编解码和
8K HDR显示能力,可支撑 AI 与图形、多媒体融合场景。 - 支持
PCIe 5.0 x16、硬件虚拟化、SR-IOV隔离和MUSA安全引擎2.0。 - 基于 MUSA 软件栈与
MUSIFY工具,可平滑迁移现有 CUDA 程序。
典型应用场景
- 大语言模型训练、微调和推理
- 图形渲染与数字内容创作
- 视频处理与多媒体服务
- 虚拟化和多租户 GPU 资源隔离

