跳到主要内容

版本发布信息

注意:以下两个版本并非前后替代关系,其组件版本、适配硬件、优化的模型种类有区别,请用户根据自身的业务场景进行选择。

ONNX Runtime 1.23.0 + ep 0.27.7​

镜像地址​

GPUCPU 平台宿主机驱动镜像地址
S5000Intel/AMD/Hygon3.3.8-serverregistry.mthreads.com/mcconline/inference/onnxruntime:1.23.0-ep0.27.7-amd64-ph1-musa4.3.8
S4000Intel/AMD/Hygon3.3.4-server 及以上registry.mthreads.com/mcconline/inference/onnxruntime:1.23.0-ep0.27.7-amd64-qy-musa4.3.2

模型支持范围​

支持图像分类、目标检测、图像分割、超分辨率、OCR、语音识别与合成、声纹、文本编码等常见 AI 模型。

功能更新​

  • 支持近百个标准 ONNX 算子,10多个扩展/融合算子,10多个融合 pass,覆盖基础运算、张量变换、归约、注意力及融合算子。
  • 支持 ONNX Runtime 1.23.0,MUSA SDK 4.3.8(S5000)及 MUSA SDK 4.3.2(S4000),并提供 Python 与 C++ 推理接口。
  • 稳定性与 NHWC 布局修复:修复多设备输出读取时的缓冲区复用问题;修复开启 prefer_nhwc 后一维卷积计算错误、Resize 动态缩放参数校验失败,以及动态卷积权重导致模型运行失败的问题。

ONNX Runtime 1.26.0 + plugin-ep 0.1.0​

镜像地址​

GPUCPU 平台宿主机驱动镜像地址
S5000Intel/AMD3.3.8-serverregistry.mthreads.com/mcconline/inference/onnxruntime:1.26.0-plugin0.1.0-amd64-ph1-musa4.3.8
S5000Intel/AMD5.1.0-server 及以上registry.mthreads.com/mcconline/inference/onnxruntime:1.26.0-plugin0.1.0-amd64-ph1-musa5.1.0

模型支持范围​

覆盖 AFM、DeepFM、DIN/DIEN/DSIN、DCN/DCNMix、MMOE、PLE、ONN 等主流搜索推荐/排序模型结构与算法,可支撑召回、精排、多任务与序列行为建模等场景。

功能更新​

  • 支持近百个算子类型和100多个 kernel 注册,覆盖基础运算、张量变换、归约、注意力及融合算子。
  • 支持 ONNX Runtime 1.26.0、MUSA SDK 5.1.0 & 4.3.8,并提供 Python 与 C++ 推理接口。
  • 修复 muDNN FP32 Conv 路径未正确应用 bias 的问题。