DeepSeek V4 Flash低价背后:调价预告凸显算力成本压力
DeepSeek在V4 Flash正式版以极低价格引发开发者调用狂潮后,于8月6日突然预告API整体提价。实测显示该模型修复生产bug成本仅0.88元,性能在多项基准超过旗舰Pro,价格仅为竞品几十分之一。提价背后是巨额算力基建投入与服务器并发压力,行业价格战或进入转折点。
事件概述
8月6日,DeepSeek在用户后台发布调价预告,计划对全部API接口服务整体提价,预计涨幅较大,官方建议开发者合理规划调用量,具体细则待后续公告。此次调价距离V4 Flash正式版上线仅7天。
7月31日,DeepSeek V4 Flash正式版上线公测。模型沿用预览版的2840亿总参数、130亿激活参数MoE架构,仅重做了后训练。官方公布的9项Agent基准测试中,正式版全面超过旗舰V4-Pro预览版,指令遵循能力明显提升,并原生支持Responses API,开发者可在ChatGPT桌面端或VS Code插件中将底层引擎切换为DeepSeek。
实测与能力边界
实测中,V4 Flash正式版被用于修复一个舆情管理系统的生产bug:信源匹配数量从约10000条骤降至不到2000条。模型遍历代码后定位到归档写出错误,从定位到给出方案不到3分钟,一次修复成功,匹配数量恢复至11020条。整个项目消耗约21.7万Token,缓存命中率99.8%,按正式版定价估算总成本约0.88元人民币;仅算bug定位与修复,成本0.27元。
模型短板包括不支持多模态图像输入,以及复杂长流程任务规划能力有限。
价格锚点与市场冲击
第三方评测Artificial Analysis综合智能指数显示,V4 Flash正式版得分50,低于Kimi K3(57分)和智谱GLM-5.2(51分)。但其输出定价为每百万token 0.28美元,而GLM-5.2为4.29美元(约15倍),Anthropic Claude Fable 5为50美元(约178倍)。按综合任务口径,V4 Flash平均任务成本约0.03美元,Kimi K3约0.86美元,Fable 5约3.15美元,最大差距105倍。在Agent高频调用场景下,成本差距被指数级放大。
V4 Flash上线前后,OpenAI宣布GPT-5.6系列调价,入门款Luna降价80%;智谱8月1日重新开放GLM Coding Plan订阅。行业价格锚点正在被重塑。
算力账单与融资压力
V4 Flash正式版在OpenRouter平台创下单周7.1万亿Token消耗量,极低价格引发开发者“报复性”调用,高峰并发使服务器集群不堪重负。在自建智算中心尚未完全交付的情况下,通过提价筛选高价值客户、抑制低效高频消耗,成为缓解服务器压力的直接手段。
同时,重资产基础设施投入巨大。DeepSeek已重启第二轮融资,计划募资500亿元,投前估值约5000亿元;两个月前刚完成首轮510亿元融资,投资方包括国家人工智能产业投资基金、腾讯、宁德时代等。两轮合计超千亿元募资中,超六成计划用于自建智算中心与国产芯片适配,另有一条一年前已秘密启动的自研推理芯片产线。梁文锋曾表示,采购服务器约10个月可通过API收入收回成本,此前低价并非补贴,而是算法优化带来的结构性成本优势。但硬件周期与现金流压力无法被无限平抑。
值得关注
8月6日的调价预告,标志着靠“价格战”互相放血的阶段可能结束。DeepSeek以克制的产品形态、极致API定价与千亿级重资产基建构成其商业底色;在阿里、腾讯、字节等争夺C端AI办公场景的同时,DeepSeek选择对API价格作出调整。这一刹车动作,也被视为行业对商业化物理规律的一次重新校准。
