(資料圖片)
2月12日,智譜正式發布新一代大模型 GLM-5。同日,摩爾線程宣布,其旗艦級AI訓推一體GPU MTT S5000已基于 SGLang 推理框架,Day-0完成對 GLM-5的全流程適配與驗證。
據介紹,依托第四代 MUSA 架構的廣泛算子覆蓋與生態兼容能力,摩爾線程已打通 GLM-5模型推理全鏈路,并釋放 MTT S5000原生 FP8加速能力。在確保模型精度的同時,顯著降低顯存占用,實現高性能推理表現。此次同步適配也被視為國產全功能 GPU 對最新大模型實現“即時支持”的重要案例。
硬件層面,MTT S5000面向大模型訓練與推理場景設計,單卡 AI 算力最高可達1000 TFLOPS,配備80GB 顯存,顯存帶寬1.6TB/s,卡間互聯帶寬784GB/s,完整支持 FP8至 FP64全精度計算。基于 MUSA 全棧平臺,該卡原生兼容 PyTorch、Megatron-LM、vLLM、SGLang 等主流框架,支持萬卡級訓練集群與高并發在線推理部署。
摩爾線程表示,從GLM-4.6、GLM-4.7到GLM-5,摩爾線程已將“發布即適配”化為常態,這種對主流軟件棧的無縫兼容與敏捷響應,充分證明了國產全功能GPU及MUSA軟件棧的成熟度與穩定性,確保開發者能第一時間觸達最新模型能力,從而攜手共建蓬勃發展的國產AI生態。(袁寧)




























