ithome
科技
采集 2026-07-23T10:32:07+00:00
阿里云灵骏真武M890适配Qwen3.8,成国内首个运行超2万亿参数的超节点
原始标题:阿里云灵骏真武 M890 适配 Qwen3.8,成国内首个成功运行超 2 万亿参数大模型的超节点
来源
ithome
发布时间
2026-07-23T08:13:21
采集批次
2026-07-23-10
字数
491
URL 指纹
184b2bb230dc131b
📌 AI 总结(218 字)
阿里云宣布灵骏真武M890超节点实例成功适配旗下旗舰模型Qwen3.8(参数规模达2.4万亿),并在百炼平台上线推理服务,成为国内首个成功运行超2万亿参数大模型的超节点。该超节点采用平头哥新一代AI芯片,通过ICN Switch 1.0互联芯片实现64张GPU卡800GB/s高速互联,显存规模达9TB,可支撑大规模MoE模型专家并行需求。同时阿里从芯片到云平台进行全链路优化,实测在Agentic推理场景中最多可实现1.5倍性能提升。
📄 正文(491 字)
今日,阿里云宣布灵骏真武M890超节点实例已成功适配Qwen3.8,并上线阿里云百炼平台提供模型推理服务,这是国内首个成功运行超2万亿参数大模型的超节点。 据介绍,Qwen3.8是阿里最新旗舰模型,参数规模高达2.4万亿,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的GPU卡,让万亿参数「跑得又稳又快」。然而,普通AI集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。 真武M890是平头哥新一代训推一体AI芯片,原生支持FP32到FP4等多种数据精度,可应用于高精度训练、低精度和超低精度推理的全场景。灵骏真武M890超节点实例通过ICN Switch 1.0互联芯片,让64张真武M890实现了800GB/s的高速互联,显存规模达到9TB,单实例即可支撑大规模2万亿参数MoE模型的专家并行需求。 此外,阿里还从芯片到云平台层面实现了与Qwen模型的全链路优化,不仅可以丝滑跑通Qwen3.8,还能显著提升推理效率、降低推理成本。实测数据显示,通过算子优化和软硬件架构协同,该超节点实例在Agentic推理场景中最多可实现1.5倍的推理性能提升。