产品介绍
本章节介绍 Linux 服务器驱动文档覆盖的 MTT S5000 与 MTT S4000 两款产品,包括产品定位、关键能力和典型应用场景。环境兼容性与安装方法,参见发布版本信息和安装指南。
MTT S5000
产品定位
MTT S5000 是面向生成式 AI 训练、推理和高性能计算的训推一体全功能 GPU 智算卡,基于第四代 MUSA 全栈平台,核心搭载 PH100 芯片。
主要特性
- 单卡 AI 稠密算力最高可达
1000 TFLOPS,满足大模型训练和推理的高算力需求。 - 支持从
FP8到FP64的全精度算力,适用于大模型训练、微调和推理。 - 单卡提供
80 GB显存和1.6 TB/s显存带宽,可满足大参数模型和高吞吐任务的数据访问需求。 - 支持
MTLink8 卡全互联,卡间互联带宽可达784 GB/s,便于构建大规模训练和推理集群。 - 提供风冷和液冷形态,可覆盖数据中心不同部署方案。
- 原生适配
PyTorch、Megatron-LM、vLLM、SGLang等主流框架,便于将现有代码迁移到 MUSA 平台。
典型应用场景
- 大语言模型训练与微调
- 高并发、低时延在线推理
- 高性能计算
- 多媒体处理与安全计算
MTT S4000
产品定位
MTT S4000 是面向大模型训练、微调和推理的智算加速卡,采用第三代 MUSA 架构,兼顾 AI 计算、图形渲染、多媒体处理和超高清显示能力。