华为发布AI时代的全新计算架构 – Peerium计算架构。该架构能实现百万级处理器成为一台计算机,以满足不断发展的AI算力需求。
Peerium计算架构是基于嵌套并行,统一内存寻址、平等互联实现百万级处理器强扩展的计算架构。Peerium计算架构突破了图灵范式,提出了Nested BSP,突破了冯·诺依曼单机架构,颠覆了长久以来的主从架构,实现了百万级处理器真正成为一台更大的计算机。
灵衢是实现Peerium计算架构的关键互联技术。灵衢是基于一个开放协议,可无限扩展地联接CPU、NPU、内存、SSD、网卡和交换机的高速总线。有了灵衢,可实现计算、存储和网络的平等互联。

基于灵衢的计算系统具备四大特征:
一、协议归一,内存语义。将十余种互联协议统一为灵衢协议,互联带宽从百GB级提升至TB级,RTT通信时延从7微秒压缩至2微秒,支持超节点内全局内存统一编址。
二、多样算力,异构协同。CPU、NPU、内存、SSD等通过灵衢直接互联,实现去中心化平等访问,CPU和NPU资源可灵活配比。通过分层分级Transformer硬加速,解耦Attention与FFN,实现AF分离部署。
三、分级存储,全局池化。以混合介质资源池化解决激活值缓存问题,将DDR作为NPU“第二内存”,降低搜推广业务时延,千亿级、数千维向量检索性能翻番;降低10T大模型训练对单卡HBM的容量需求,助力提升集群MFU。
四、光电互联,灵活组网。构建全局超高带宽、超低时延“数据高速公路”,实现大小算力灵活扩展。
Atlas 950超节点是Peerium计算架构的首代产品,25.6万卡Atlas 950超节点集群已经在部署中,基于NPO的Atlas 960系统正在测试中。
华为轮值董事长徐直军表示:“AI时代,华为基于开创的Peerium计算架构,持续打造满足客户训练和推理需求的超节点和集群,让算力无处不在,让智能无所不及。”