有个特别荒诞的画面最近一直在脑子里转。
你打开浏览器,屏幕上跳出来的东西,六成是机器写的、机器抓的、机器重新排列组合后喂给你的。
Cloudflare的数据说,今年6月,全球网页请求流量里AI机器人已经超过人类,占比在53%到60%之间晃悠。
HUMAN Security的报告显示,代理型AI流量的同比增速飙到了7851%,是人类流量增速的八倍。
八倍什么概念?就是机器正在以你根本反应不过来的速度,把互联网重新装修成它自己的样子。
但这还不是最荒诞的。
最荒诞的是,这些机器在互相学习。
西北大学的研究发现,现在AI搜索工具每引用6个来源,就有1个本身已经是AI生成的网站。
Graphite的数据显示,从2024年开始,全网超过一半的新英文文章出自AI之手。等于说AI正在吃AI自己吐出来的东西,一代喂一代。
牛津大学和剑桥大学的学者在《自然》上发表的研究早就警告过这个现象:模型崩溃,意思是当AI反复在AI生成内容上训练,输出质量会逐步退化,最后变成统计学意义上的胡言乱语。
一个用中世纪建筑文本做测试的模型,到第九代输出已经变成了一串野兔的名字。
所以你能看到特别魔幻的一幕:AI公司开始满世界抢2022年以前出版的旧书。
Anthropic被曝光的“巴拿马计划”,斥资数千万美元买了约200万册实体书,切掉书脊高速扫描,扫完直接销毁。
为什么非要2022年以前?因为那年ChatGPT火了之后,互联网就被AI生成内容淹了,旧书是最后一批没被污染的人类原创语料。
这场“机器反噬”的另一面,是互联网用了几十年的那套流量契约正在瓦解。
过去网站免费向搜索引擎开放内容,换取用户点击和流量,大家各取所需。
现在AI爬虫来了,把你的内容抓走训练模型、生成答案,却很少回链原始出处。
优质网站流量断崖式下跌,只能被迫屏蔽爬虫。
百度App的月活一年掉了近7000万,用户越来越习惯直接从AI助手要答案,而不是点链接。
ChatGPT每周网页搜索量早已超过10亿次,Perplexity的月查询量也冲破了10亿。
传统搜索那套“搜索-点击-浏览”的路径,正在被“提问-获得答案”直接取代。
但这里有个反差:AI流量已经占了近六成,可它带来的经济收益却小得可怜。
IMF预测AI每年对全球经济增长的贡献大约0.5个百分点,放在全球GDP大盘子里几乎可以忽略不计。
所以整件事看下来,像是一个巨大的悖论:我们用尽全力让AI学会像人一样说话,结果AI说得太多,把人类原本说的话都淹没了。
AI为了继续学得像人,又不得不回头去抢“机器时代之前”的人类文字。
而人类,一边享受着AI给答案的便捷,一边发现整个互联网的信任地基正在松动:现在看到任何东西,第一反应都是“这是AI做的吗?”
互联网三十年的变化太快了,快到我们还没想清楚:当机器成了互联网的大多数,这个网,还是为人类设计的吗?