云霞资讯网

黄仁勋可能要头疼了。彭博社援引知情人士的话报道,DeepSeek正在内蒙古乌兰察

黄仁勋可能要头疼了。彭博社援引知情人士的话报道,DeepSeek正在内蒙古乌兰察布筹建一座1吉瓦的大型AI数据中心。

1吉瓦是什么概念?一座中小型核电站满负荷运转的功率,足以让数十万张AI加速卡同时跑起来。

更关键的是,这座算力中心用的全是国产芯片。华为昇腾、寒武纪、海光,一张英伟达的卡都不用。你没听错,就是那个曾经被认为"离开英伟达就活不了"的中国AI行业,现在要建一座纯国产的万卡级甚至十万卡级算力工厂。

这事儿的分量,很多人还没真正意识到。我给你算笔账。过去训练一个顶级大模型,动不动就要上万张H100,一张卡几万美金,光硬件成本就是几十亿。美国人掐住芯片供应,等于掐住了中国AI的命门,这是他们手里最硬的一张牌。

但DeepSeek从一开始就没按这个剧本走。去年V3模型出来的时候,整个行业都震惊了——2048张H800,不到两个月,训练成本才557.6万美元。别人烧十亿美金干的活,他们花不到六百万就干了,效果还不差。

这就是梁文锋最厉害的地方。他不是跟你拼谁的卡多,而是拼谁把每一张卡的潜力榨得更干净。GRPO算法把内存消耗砍到原来的三分之一,FP8混合精度让内存占用减半、计算速度提三成,数据蒸馏把无效数据从15%压到3%。每一项优化,都是在跟算力极限死磕。

你想想,当一家公司能用别人五分之一的算力,跑出差不多的模型效果,那断供的威慑力还剩多少?就好比你本来想断人家的粮,结果人家学会了亩产万斤,你手里的粮票还值钱吗?

这还只是算法层面的优化。乌兰察布这座1GW算力中心,是从硬件根上解决问题。以前我们用英伟达的卡,相当于买人家的成品电,电价人家说了算,还随时可能拉闸。现在自建全国产算力中心,等于自己建了一座发电厂,从发电到输电全是自己的。

我个人觉得,这步棋的战略意义,怎么高估都不为过。它标志着中国AI产业从"借船出海"正式转向"自己造船"。以前是有什么卡用什么卡,现在是从芯片到集群到模型,整条链条都在自己手里攥着。

你再看黄仁勋最近的表态,很有意思。五月份他在美国智库的活动上说,英伟达在中国AI加速器市场的份额已经降到了0%。说这话的时候,他的语气里有抱怨,有无奈,还有点焦虑。

换作三年前,谁敢信这话?2023年的时候,英伟达还占着中国AI芯片市场九成以上的份额,黄仁勋来中国像明星一样,各大公司排着队见。才两年时间,市场份额直接清零,这变化速度谁能想到?

美国人的初衷是什么?是用芯片限制把中国AI锁死在落后位置,让我们永远跟在他们屁股后面跑。结果呢?限制了两年,中国AI不仅没被锁死,反而逼出了一套完整的国产替代体系。从芯片到框架到模型,全都有了。

我认为这里面有一个很容易被忽略的逻辑:断供从来不是单方面的伤害,它是一把双刃剑。你砍了别人的供应链,同时也给了对方一个必须自己干的理由和动力。本来可能还要犹豫十年,现在三年就干成了。

当然,我得说句公道话,国产芯片跟英伟达最顶级的产品比,单卡性能确实还有差距。这个得承认,不能自欺欺人。但问题是,AI竞赛比的从来不是单卡性能,而是系统效率。

打个比方,你有一辆法拉利,但路不好,你跑不起来。我开的是国产车,但我把路修得又宽又平,还优化了行驶路线,最后谁先到终点还真不一定。DeepSeek干的就是修路和优化路线的活儿。

你看V4版本,官方技术报告里直接把华为昇腾和英伟达写进了同一份硬件清单。昇腾950PR推理芯片,单卡算力比美国特供版H20还强2.87倍。发布当天,百度千帆、寒武纪、摩尔线程、华为昇腾全部完成适配,这速度以前谁敢想?

还有一个细节,很多人没注意到。DeepSeek今年四月份就开始在乌兰察布招人了,守机房的岗位,月薪三万。那时候彭博社的报道还没出来,说明这事儿早就开始布局了,不是临时起意。

再加上宁德时代入股,这盘棋就更清楚了。从模型算法,到芯片硬件,再到能源电力,梁文锋在搭的是一条完整的产业链。不是单点突破,是全线推进。

我相信再过几年回头看,乌兰察布这座算力中心会是一个标志性的事件。它不只是一个数据中心,更是一个信号——中国AI产业已经从被动应对,转向了主动布局。从跟着别人走,变成了走自己的路。

这条路肯定不会一帆风顺,还会有很多困难和挑战。但方向是对的,势头是好的。只要我们继续扎扎实实地干,把每一个技术细节都做到极致,把每一分算力的效率都榨干,那就没有什么坎是过不去的。