很多人以为大模型是奢侈品,只有巨头才玩得起。
但DeepSeek这次直接把这个认知掀翻了。
先看一组实测数字。
Artificial Analysis跑同一套基准测试,Claude Fable 5一次任务3.15美元,GPT-5.6 Sol要1.86美元,DeepSeek V4-Flash只要3美分。
从3美元到3美分,便宜100倍,速度还快1.5倍。
这不是简单的性价比,而是把整个行业的定价逻辑重写了。
为什么DeepSeek能便宜到这个程度?
第一,架构够省。
V4-Flash总参数2840亿,但每次推理只激活130亿,不到5%,相当于开会只喊最对口的人。
第二,训练够巧。
参数没动,光靠后训练把Terminal Bench从61.8分提到82.7分,先分科培养再融会贯通,成本几乎没涨,能力接近翻倍。
第三,定价够狠。
假设一家公司一天跑100万次API调用,用Claude一天3.15万美元,用DeepSeek只要300美元,一年差1130万美元。
于是企业开始搞模型路由,关键任务交给旗舰模型,80%的批量苦力活丢给DeepSeek。
Menlo Ventures调研显示,37%的企业已同时用5个以上模型。
这才是真正的杀伤力所在。
彭博社把中间那一档模型的处境叫作死亡区,往上够不着旗舰能力,往下打不过DeepSeek价格。
李开复说得直接,如果没有中国开源模型,OpenAI和Anthropic本可以轻松躺赚。
现在这两家都在筹备万亿美元估值上市,需要高垄断、高定价权,而DeepSeek恰恰把定价权这块地基拆了。
它没跟谁比谁更聪明,而是告诉全世界,大模型不该是奢侈品,应该像水电煤一样随手可用。
一旦这个认知立住,所谓AI界的爱马仕就没那么好卖了。
对中国AI产业而言,这是一次实打实的技术突破,也是全球开放秩序里一次有分量的发声。
