7 月 23 日消息,今日,阿里云宣布灵骏真武 M890 超节点实例已成功适配 Qwen3.8,并上线阿里云百炼平台提供模型推理服务,这是国内首个成功运行超 2 万亿参数大模型的超节点。

据介绍,Qwen3.8 是阿里最新旗舰模型,参数规模高达 2.4 万亿,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的 GPU 卡,让万亿参数“跑得又稳又快”。然而,普通 AI 集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。
IT之家注意到,真武 M890 是平头哥新一代训推一体 AI 芯片,原生支持 FP32 到 FP4 等多种数据精度,可应用于高精度训练、低精度和超低精度推理的全场景。灵骏真武 M890 超节点实例通过 ICN Switch 1.0 互联芯片,让 64 张真武 M890 实现了 800GB/s 的高速互联,显存规模达到 9TB,单实例即可支撑大规模 2 万亿参数 MoE 模型的专家并行需求。
此外,阿里还从芯片到云平台层面实现了与 Qwen 模型的全链路优化,不仅可以丝滑跑通 Qwen3.8,还能显著提升推理效率、降低推理成本。实测数据显示,通过算子优化和软硬件架构协同,该超节点实例在 Agentic 推理场景中最多可实现 1.5 倍的推理性能提升。