DeepSeek加入涨价潮:算力峰谷计价落地,大模型免费时代落幕

2026/08/21 13:11阅读量 1

DeepSeek调整API计价方案,引入算力峰谷分级定价,缓存命中输入价格从0.025元涨至0.3元,涨幅1100%。此前豆包、Kimi、智谱AI、MiniMax、腾讯云等已纷纷上调价格或推出付费订阅。本轮涨价背后是算力成本高企与商业化压力,大模型行业正从免费获取转向分层付费。

DeepSeek 于近日调整 API 计价方案,在国产大模型中引入“算力峰谷分级计价”。一天被分为高峰时段(9:00-12:00、14:00-18:00)和闲时时段,闲时价格为高峰的一半。其中 V4-Pro 高峰时段输出价涨至 27 元/百万 tokens,为旧价的 4.5 倍;缓存命中输入价从 0.025 元涨至 0.3 元,涨幅达 1100%。

行业涨价潮

  • 豆包率先在 2026 年 5 月推出 C 端付费会员,标准版 68 元/月、加强版 200 元/月、专业版 500 元/月,长文档处理、批量生成、高峰优先算力分配等功能改为付费专享。
  • Kimi 在 7 月发布 K3 后启动会员制,四档会员每月 39 元至 559 元,但上线不到 48 小时即因请求量暴增、GPU 集群承压而叫停 C 端新用户订阅。B 端方面,K3 输出价涨至 100 元/百万 token(涨 3.5 倍),输入价 20 元/百万 token(涨 3 倍)。
  • 腾讯云 3 月结束 GLM 5、MiniMax 2.5 等第三方模型的免费公测,自研混元 HY2.0 Instruct 输入价从 0.0008 元/千 tokens 上调至 0.004505 元,涨幅 463%;4 月又对 AI 算力产品统一涨价 5%。
  • 智谱 AI 年内五次上调 API 价格,2026 年一季度 API 定价较 2025 年底上涨约 83%,但调用量同比大增 400%。
  • MiniMax 6 月 1 日发布 M3 模型时,API 输入从 2.1 元涨至 4.2 元,输出从 8.4 元涨至 16.8 元,最低套餐从 29 元涨至 49 元,且未提前通知。

涨价原因与商业化拐点

这轮涨价的直接原因是算力硬成本。生成式 AI 每次调用都在消耗 GPU 电力、设备折旧和算力资源。豆包月活已达 3.82 亿,Token 调用量突破 180 万亿,据行业测算其单日烧钱超千万元,而 2026 年 5 月日收入不足百万元。字节跳动 2026 年 AI 基础设施开支预计达 2000 亿元。国家数据局数据显示,2026 年 3 月中国日均 Token 调用量达 140 万亿,较 2024 年初增长超千倍。低价策略还吸引大量低价值、高并发的无效请求(如爬虫、测试脚本),挤占企业客户算力。DeepSeek 的“峰谷电价”实际是借鉴电力行业削峰填谷思路,用价格杠杆把拥堵请求转移到低谷时段,避免为峰值流量持续扩容 GPU 集群。

在商业化路径上,豆包除会员外,已开始对订酒店、打车等交易抽取支付渠道服务费,相关能力处于灰度测试中。字节跳动 CEO 梁汝波表示,希望豆包成为类似抖音的“主干”业务,长出电商、生活服务等分支。其他厂商则分别通过技术迭代、聚焦高价值场景或全线提价寻求可持续模式。

免费 AI 时代正在落幕,行业从烧钱抢用户转向按价值分层收费。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。