阿里云近日宣布,其自主研发的灵骏真武M890超节点实例已成功适配并运行Qwen3.8大模型,成为国内首个具备支撑超2万亿参数模型能力的计算平台。该成果标志着我国在超大规模AI模型部署领域取得重要突破,为全球AI算力发展提供了全新解决方案。
作为阿里最新一代旗舰模型,Qwen3.8参数规模达2.4万亿,其运行需要依托高度优化的硬件架构。传统AI集群受限于通信带宽,难以满足万亿级参数模型对高吞吐、低延迟的严苛要求。阿里通过技术创新,将模型参数分散至数十张甚至上百张GPU卡,通过高速互联技术实现协同计算,有效解决了这一行业难题。
灵骏真武M890超节点的核心优势在于其革命性的硬件设计。该平台搭载平头哥新一代训推一体AI芯片,支持从FP32到FP4的全精度计算,可同时满足高精度训练和低精度推理需求。通过ICN Switch 1.0互联芯片,64张真武M890实现了800GB/s的极致带宽,显存规模突破9TB,单实例即可支撑2万亿参数MoE模型的专家并行计算。
在软件优化层面,阿里构建了从芯片到云平台的完整优化体系。通过算子级优化和软硬件协同设计,Qwen3.8在灵骏平台上的推理效率得到显著提升。实测数据显示,在Agentic推理场景中,该平台可实现最高1.5倍的性能提升,同时有效降低计算成本。这种全链路优化能力,为AI模型的大规模商业化应用奠定了坚实基础。
此次技术突破不仅展现了阿里在AI基础设施领域的领先地位,更为全球AI产业发展提供了重要参考。随着大模型参数规模持续扩大,对计算平台的要求将越来越高。灵骏真武M890超节点的成功实践,为行业探索出一条高效、可靠的超大规模模型部署路径,有望推动AI技术向更广泛的应用场景渗透。




