在华为全联接大会期间,华为常务董事、ICT BG CEO杨超斌发表主题演讲,系统阐述了面向Agentic AI时代的计算架构创新,正式推出以灵衢互联为核心的系列化算力底座,并宣布通过生态开放策略赋能行业智能化转型。
传统计算架构在应对大规模AI训练时面临显著瓶颈。当集群规模扩展至十万卡级别时,实际模型算力利用率不足20%,大量计算资源因通信延迟处于闲置状态。以10T参数大模型为例,其训练过程中产生的海量中间数据远超单张显卡内存容量,而Agent与模型的高频交互(每小时数百次)更对CPU与NPU的协同效率提出严苛要求。跨系统、跨层级的存储需求激增,使得集群内部件的互联能力成为制约整体性能的关键因素。
针对上述挑战,华为提出灵衢互联架构,通过四大技术特征重构计算系统:在协议层面,将十余种互联协议统一为灵衢协议,使互联带宽从百GB级跃升至TB级,通信时延从7微秒压缩至2微秒,并支持超节点内全局内存统一编址;算力协同方面,CPU、NPU、内存及SSD通过灵衢实现去中心化平等访问,资源配比灵活可调,并通过分层分级Transformer硬加速技术实现AF分离部署;存储架构上,采用混合介质资源池化方案,将DDR作为NPU“第二内存”,显著降低搜推广业务时延,同时减少对单卡HBM容量的依赖;在组网能力上,构建光电融合的“数据高速公路”,支持从单柜到百万卡集群的弹性扩展。
基于灵衢架构,华为发布覆盖柜内、跨柜与集群三级互联的硬件设备体系。其中,柜内互联刀片通过零电缆设计实现4096超节点内196公里铜缆的节省;跨柜互联设备支持176个1.6T端口,单机全光互联带宽达280T,时延低至2微秒,创行业新纪录;UBG网络交换机具备1024超大Radix扇出能力,可支撑百万卡超节点集群,满足模型参数向几十万亿级演进的需求。华为还推出由鲲鹏950、昇腾960超节点、OceanStor M900记忆存储及星河UBG交换机组成的Agentic AI超节点集群,实现算力协同与资源池化的深度整合。
在边缘计算场景,华为基于灵衢架构打造从1卡到8卡的系列化一体机及鲲鹏昇腾模组。以Atlas 650E风冷服务器为例,其通过双机灵衢直连技术实现16个NPU免交换互联,两台设备可无缝协同运行,支持中小企业本地部署万亿参数大模型。该方案通过硬件解耦设计,使企业能够根据业务需求灵活扩展算力规模。
生态建设方面,华为与DeepSeek Harness、OpenCode、openJiuwen等开源框架深度协同,开源智能管理、推理加速及安全框架等Agent插件化组件。目前,已联合50余家客户、伙伴及高校构建26个行业算子库,并与90多家主流开源社区建立合作,助力开发者快速完成行业Agent开发与IT系统对接。杨超斌在演讲中强调:“华为将持续推进系统级创新,通过开源开放策略构建算力生态,为全球智能化转型提供差异化选择。”
本届华为全联接大会以“智启新未来”为主题,通过战略解读、技术发布及生态展示三大维度,呈现华为在全面智能化领域的最新实践。除算力架构创新外,大会还发布多项行业智能化应用样板点及开发者工具平台,涵盖制造、金融、能源等重点领域。