都市热线

华为发布面向超节点与集群的全新灵衢计算架构

来源:华为技术有限公司

上海2026年9月22日 美通社 -- 在华为全联接大会2026一场聚焦计算架构创新的主题演讲中,华为常务董事、ICT BG CEO杨超斌揭晓了灵衢(UnifiedBus)互联架构的更多细节,发布一系列基于灵衢互联架构的计算产品,并介绍华为如何携手开源社区,使能客户、伙伴与开发者应用创新。

Yang Chaobin delivering a keynote at HUAWEI CONNECT 2026
Yang Chaobin delivering a keynote at HUAWEI CONNECT 2026

在传统计算架构下,集群规模扩大时,资源利用率反而下降,十万卡集群的实际模型算力利用率仅约20%,大量算力处于等待通信完成的状态。10T参数大模型的训练需要海量中间数据,传统架构下单个加速卡的内存容量已难以承载。集群内不同部件之间的互联与通信能力,已成为决定计算系统性能的关键。

杨超斌表示,华为破解这一瓶颈的解决方案,就是这套依托灵衢互联技术打造的新计算架构,实现集群与超节点之间的协同。该架构的设计初衷,是顺应各类新型智能体应用落地所带来的算力爆发式增长需求。基于灵衢的计算系统具备四大特征:

  • 协议归一,内存语义:将十余种互联协议统一为灵衢协议,互联带宽从百GB级提升至TB级,RTT通信时延从7微秒压缩至2微秒,支持超节点内全局内存统一编址。
  • 多样算力,异构协同:CPU、NPU、内存、SSD等通过灵衢直接互联,实现去中心化平等访问,CPU和NPU资源可灵活配比。通过分层分级Transformer硬加速,解耦Attention与FFN,实现AF分离部署。
  • 分级存储,全局池化:以混合介质资源池化解决激活值缓存问题,将DDR作为NPU“第二内存”,降低搜推广业务时延,千亿级、数千维向量检索性能翻番;降低10T大模型训练对单卡HBM的容量需求,助力提升集群MFU。
  • 光电互联,灵活组网:构建全局超高带宽、超低时延“数据高速公路”,实现大小算力灵活扩展。

随后,杨超斌发布最新的灵衢互联设备,覆盖柜内、跨柜与集群三级互联,支持从单柜到百万卡集群的弹性扩展。

  • 柜内,灵衢互联刀片实现零电缆、零电路损耗,一个4096卡超节点可节省196公里铜缆。
  • 跨柜灵衢互联设备支持176个端口,每端口达1.6T,单机280T全光互联,是业界互联带宽最大、端口数最多的高速总线协议互联设备,RTT时延低至2微秒。
  • 在跨集群方面,UBG灵衢网络交换机具备高达1024的超大Radix扇出能力,可支撑百万卡超节点集群,满足模型参数向几十万亿演进的需求。

同时,杨超斌还发布了华为基于灵衢的Agentic AI超节点集群,由TaiShan 950(鲲鹏950)、Atlas 960(昇腾960)超节点、OceanStor M900记忆存储及星河UBG交换机组成,实现多样算力协同与分级资源池化。

灵衢互联技术不仅用于超节点,也适用于一体机。华为基于灵衢架构打造从1卡到8卡的系列化一体机及鲲鹏、昇腾模组,让中小企业也能本地运行万亿参数大模型。

杨超斌介绍,生态方面,昇腾与DeepSeek Harness、OpenCode、openJiuwen等开源框架协同,打造智能管理、推理加速、安全框架等Agent插件化组件并全量开源。

杨超斌表示:“华为将坚持系统级创新,构筑系列化算力底座,开源开放,联合客户、伙伴和开发者共建生态,为世界提供新选择。”

标签: