云霞资讯网

前几天,我去了一场闭门会。新浪财经的 AI 投资峰会上,有一桌圆桌,聊的是超节点

前几天,我去了一场闭门会。新浪财经的 AI 投资峰会上,有一桌圆桌,聊的是超节点。那天的核心问题就一个,造不出最快的芯片,怎么办?

答案就一句话,换一种追法,把上百张芯片连成一台电脑。

先说为什么非换不可。国产最顶的那张算力芯片,跟H100 比,单卡算力是五六成;工艺还差着大概两代,追起来按年算,最先进的光刻机还买不到。

另一边,模型不等人。不到四年,参数翻了十几倍,两万八千亿的那种,一台八卡机已经装不下。台上原话,8卡跑不起来,得32卡起步。一头追不平,一头装不下。

换法就一个字,连。

大模型拆成一大堆「专家」,散在几百张卡上,一天到晚互相传话;传话一堵,几百张卡一起等。

卡和卡之间靠线传话。铜线便宜,就是跑不远,英伟达那边,最多连到72张,就到顶了。换成光,线就拉长了,384张、1024张,一台一台往上连。

连出来的是逻辑上的一台电脑,几百张卡的显存拼成一池,谁要读什么,直接伸手拿。《超节点定义与实践白皮书》的原话是,逻辑上,就是「一台计算机」。

说个现场听来的细节,造这套东西的厂房,得放一楼,楼板一平米承重三吨起步,底下还不能有地下车库。

这条路也不是图纸。到9月,光华为一家,部署量过了一千套。跟英伟达眼下最顶的机柜比,算力大约是它的1.7倍,口径是系统对系统。

代价也有。同样算力,这套系统耗电约是对方的4倍。明年业内喊的是「大年」。能不能兑现,得看高带宽内存的供应,这一环供不上,出货就悬。

贵是贵,这条路,走通了。