云霞资讯网

买不起几百万的服务器,就不配做AI创业了?国家数据局在数博会上力推词元按效付费,

买不起几百万的服务器,就不配做AI创业了?国家数据局在数博会上力推词元按效付费,这消息让无数小团队沸腾。不用建算力中心,调用词元就能做产品,AI创业的门槛被一脚踹开,草根的机会来了。

有没有注意到,这两年最会讲故事的不是马斯克,是AI行业自己。

大模型一个比一个强,发布会一场比一场热闹,融资数字动辄几十亿,但你要问它一句:你tm到底怎么赚钱?现场立刻安静得像图书馆。

这个问题,国家数据局在2026数博会上,用一句话给捅破了——围绕国民经济重大场景,探索词元增值订阅、按效付费等商业模式。

翻译成人话就是:AI不能光烧钱,得想清楚怎么收钱。

这句话看似轻描淡写,背后藏的东西相当重。

先说词元这个东西。很多人看到这两个字直接划走,觉得是技术黑话。其实不神秘,你每次跟AI对话,它处理的每一个字、每一个符号,都是一个词元。你消耗了多少词元,平台就向你收多少钱,就这么直接。截至今年6月,我国日均词元调用量已经突破500万亿,两年间涨了足足一千倍。

这个数字意味着什么?意味着AI已经从少数极客的玩具,变成了每天被几亿人消耗的工业品。工业品就得有工业品的定价逻辑,不能永远靠情怀和补贴撑着。

但这里有个问题,是我觉得整件事最值得争论的地方。

按效付费,听起来公平,用多少付多少,效果好才收钱。可问题是,谁来定义"效果"?

医院用AI辅助诊断,少误诊一例算不算效果?工厂用AI优化排产,省了三个小时算不算效果?这些效果怎么量化、怎么核算、第三方怎么验证,目前没有任何人说清楚过。国家数据局自己也承认,词元至今还没有形成像"一度电""一升油"那样统一的计量标准。定价权现在基本在头部大模型企业手里,外部既无法核价,也无法监测。

换句话说,按效付费这张牌,好不好使,完全取决于规则由谁来写。

这才是这场变革里,真正的战场。

再说数据标注这件事。国家这次要在32个城市铺开先行先试,很多人觉得这是个辅助动作,不够性感。但我要说,这才是整件事里含金量最高、最被低估的一步棋。

道理很简单。模型可以买,算力可以租,但能喂给模型做训练的高质量数据,是既不能凭空造、也没办法批量复制的。工业设备的故障图像、医院的影像标注、物流分拣线上的操作数据,这些东西必须有人一帧一帧标出来、一条一条清洗出来。没有这个底层,大模型再聪明也是无源之水。

有意思的是,当市场还在争论哪家芯片股能涨多少时,真正的机会已经悄悄转移了。那些扎在工业、医疗、交通里,帮大模型把沉睡数据激活成可用词元的团队,正在成为这轮AI落地里最不起眼、却最难被替代的存在。

历史总是这样。淘金热里最稳赚的,是卖铁锹的那个人。

只是这次,铁锹换成了标注工具,金矿换成了行业数据,而那个安静卖铁锹的人,可能正在你完全没有关注的某个角落里,接着国家级订单,闷声发大财。

你觉得,这场词元经济的定价权,最终会落在谁手里?