此次降价覆盖缓存命中、缓存未命中及输出三个维度,其中输出价格调整为每百万Token 4元,高峰时段价格维持为空闲时段的2倍。此举旨在进一步降低用户使用成本,提升模型应用普及度。

▲DeepSeek
根据官方公布的调整方案,Flash系列模型(包括deepseek-v4-flash和deepseek-v4-flash-vision-exp)在空闲时段的价格将全面下调:输入缓存命中价格由每百万Token 0.05元降至0.02元,降幅达60%;输入缓存未命中价格由1.5元降至1元,降幅约33%;输出价格由4.5元降至4元,降幅约11%。高峰时段(工作日9:00-12:00、14:00-18:00)的各项价格仍为空闲时段的2倍,即缓存命中0.04元、未命中2元、输出8元。此次调价无需用户额外申请,将自动生效。

▲DeepSeek
此次降价的背景与DeepSeek近期的产品迭代密切相关。就在降价公告发布前一天,DeepSeek宣布开启V4.1 Flash中间版本的内测,新模型在速度上较前代有显著提升,但部分开发者反馈实际调用成本有所上升。官方此前曾表示新模型“成本更低”,外界普遍猜测这指的是底层推理效率的提升,而此次降价或是对开发者反馈的回应。
此外,今年8月DeepSeek V4 Pro系列上线时曾大幅上调API价格,引发部分开发者对性价比的担忧,此次Flash系列降价也被视为对整体定价策略的回调。
从行业角度看,随着AI模型逐渐从技术验证走向规模化应用,成本优化已成为厂商竞争的关键维度,DeepSeek此次降价有望推动AI应用进一步向中小企业和开发者群体渗透。
中原网·中河财经栏目组