跳到正文
中文
FikirPilot 内容

Huawei 正在利用 UnifiedBus 构建百万 NPU 人工智能集群

更新于: 2026年9月19日 · 2 分钟阅读

发布于: · 消息抵达: · 处理时长: 4 小时 16 分钟

Huawei 正在利用 UnifiedBus 构建百万 NPU 人工智能集群
巨型数据中心走廊

Huawei 通过在 HUAWEI CONNECT 2026 年发布的 UnifiedBus 架构,将处理器、内存、存储和网络组件整合到人工智能基础设施中。该系统旨在减少大模型训练和推理中的数据传输瓶颈,并作为 SuperPoD 的基础连接,采用协议和统一内存语义。据 Huawei 介绍,带宽将从每秒数百 GB 提升至每秒 TB,延迟则从 7 微秒降至 2 微秒;CPU、NPU、内存和 SSD 可直接进行点对点连接。LinkDevice 在 176 个连接端口上提供 1.6 Tbit/s 的速率和 280 Tbit/s 的光学容量;UBG 可扩展至最多 1,024 个连接。该架构支持配备 1 million 个 NPU 的 SuperCluster 以及 Peerium Computing Architecture。该架构已用于 Atlas 950 SuperPoD 和 SuperCluster;采用 NPO 技术的 Atlas 960 正在测试中。

为何重要

UnifiedBus 的重要性在于,它不是将人工智能基础设施中的处理器、内存、存储和网络资源作为相互独立的组件进行管理,而是将其置于统一的连接和内存模型之下。由于该结构旨在减少数据在组件之间传输所产生的瓶颈,尤其是在大模型训练和推理场景中,因此会直接影响基础设施规模。UBG 可扩展至最多 1,024 个连接,加上对配备 1 million 个 NPU 的 SuperCluster 的支持,表明该架构是根据从单一系统扩展到更大规模集群的使用场景而设计的。不过,Atlas 960 仍处于测试阶段,这也表明 NPO 技术在该架构中的表现仍在评估过程中。

背景

Huawei 对 FikirPilot 的档案而言并不是一个新名字:过去 90 天内,我们发布了 7 篇提到这一名称的新闻;最新一篇的日期是 2026 年 9 月 19 日。

来源: Teknoblog