OpenCode的CEO介绍 DeepSeek v4 Flash 正式版发布后,他们的的变化。因为这个模型最够好又便宜到离谱,所以他们一下子激增了大约10T Token/日。这大概需要1000 张 B300 GPU才能扛得住。所以也能知道DeepSeek为什么涨价了,单这一个渠道,就得占用大概7000张 H100的GPU。AGI还做不做了
-----------好的,我来讲讲 DeepSeek v4 Flash 最近发生了什么。
先补充一点背景。它在 8 月 1 日上线,在短短两周内,DeepSeek v4 Flash 在 OpenCode 上的日 token 使用量就从 3 万亿暴涨到了 18 万亿,足足增长了 6 倍,夸张得离谱。
这个数字有多大?作为参照,这个增量差不多相当于再造了一个 OpenRouter 的全部日流量。而且据我们估计,OpenCode 这部分用量可能已经占到 DeepSeek 总调用量的 30%–50%。
两周之内出现这种幅度的增长,绝对不正常。
之所以会发生这种事,首先是因为这个模型便宜得离谱:它比 Fable 便宜大约 350 倍,比 5.6 Sol 便宜 175 倍,比 Sonnet 便宜 70 倍,比 Luna 便宜 7 倍。其次,相比上一代 Flash 模型,它的能力也有了非常明显的提升。
我们的用户第一次真正感受到了一种“AI 便宜到几乎不用算成本”的体验。
但随后,到了 8 月 16 日,DeepSeek 突然把价格提高了 5 倍;非高峰时段也涨了 2.5 倍。这一下基本直接把模型的增长势头打断了。现在它每天处理的 token 数,已经不到峰值时期的一半。
用户显然对这种突然涨价非常不满。
我们的判断是,DeepSeek 很可能确实扛不住这次离谱的 6 倍流量增长。另一方面,GPU 价格上涨也可能意味着,即便他们继续采购新的算力容量,以新增硬件的成本来看,也已经不可能再按照原来的价格提供服务。
这里顺便解释一下,为什么 DeepSeek Flash 原本可以做到这么便宜。
看起来他们使用了一套定制化的基础设施,可以缓存远多于普通方案的 token,而且缓存保留时间也长得多。这一点非常关键,因为 DeepSeek Flash 涨价之后,我们这边一直在拼命寻找其他供应商,希望填补它留下的接近每天 10 万亿 token 的巨大缺口。
遗憾的是,目前真正能做到接近 DeepSeek 原始价格的供应商只有寥寥几家。而且他们之所以能做到这个价格,很可能也只是因为用了更新一代的硬件。
这就说到了目前的情况。
过去一周,我们几乎把能联系的人都联系了一遍,希望找到能够按照 DeepSeek 原始价格托管 DeepSeek 模型的供应商。
问题在于,即使有人技术上能够做到这个价格,他们也很难拥有足够大的算力容量来承接我们的流量。
按照我们目前的吞吐量计算,大概要用到约 1000 台 B300 服务器才能扛住。
这也是为什么,如果你过去几天一直在 Go 上使用 DeepSeek Flash,体验可能不是特别好。很遗憾,我们这几天不得不连续切换了几个不同的算力供应商。
不过,DeepSeek Flash 留下的这个每天约 10 万亿 token 的缺口,同时也是所有其他模型厂商的巨大机会。
现在已经非常明确:市场确实非常需要一种模型,它的能力至少要达到 DeepSeek Flash 的水平,同时价格也要足够低。
而且更夸张的是——DeepSeek Flash 这样的能力和价格组合,似乎还只是市场的最低门槛。
这里最后一句 “And somehow that still feels like the floor.” 的重点不是“价格已经到底了”,而是说:即使一个模型已经做到 DeepSeek Flash 这么强、这么便宜,市场给人的感觉依然是——这可能只是未来竞争的起点/最低标准,而不是一个特别高的标杆。
