算力堆到 4096 卡之后,瓶颈开始从芯片搬到网线和硬盘上。
9 月 19 日,华为计算推出 AI 网卡与 AI SSD,官方称之为计算模组产品线的重磅
双首发。时间点值得玩味,就在前一天,昇腾 960 超节点刚在上海发布,单节点 4096
卡高速互联,面向 10 万亿参数大模型训练与推理,灵衢昇腾 950 智算集群云服务也
定在 9 月 30 日商用。
芯片、网络、存储,这次凑齐了一套。
过去网络和存储是算力配角,现在角色变了。万卡集群里,卡间互联带宽决定多
卡协同效率,数据落盘速度决定训练样本周转节奏,两者一起决定算力利用率。超节
点把几千张卡串成一台机器,网卡和 SSD 就是这台机器的神经和记忆。华为补上这两
块,等于把 AI 基础设施从单点算力竞争推向系统级效能竞争。
当然,这次官方没有公布具体规格和上市安排,表态成分大于落地。效果如何,
要看实际部署数据。
你们训练集群的瓶颈,卡在 GPU、网络还是存储?

