国产大模型市场观察:四款轻量级模型周用量破10万亿tokens,头部集中度显著提升
2026/09/22 19:25阅读量 3
智能经济30人论坛AGI测评中心发布的最新报告显示,2026年9月12日至18日期间,DeepSeek V4 Flash、V4.1 Flash、腾讯Hy4 preview及智谱AI GLM 5.3 Flash四款国产模型的周词元消耗量均突破10万亿。其中,DeepSeek系列因降价策略实现用量激增,与腾讯混元共同占据近半市场份额。当前国产大模型市场呈现明显的“第一梯队”集聚效应,前四名合计份额约66%,且轻量化(Flash/类Flash)模型在用量和性价比上占据主导地位。
事件概述
智能经济30人论坛AGI测评中心发布了《AGI市场观察》周报(统计周期:2026年9月12日-18日)。该报告基于OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评,对国产大语言模型的市场表现进行了量化追踪。数据显示,国产大模型市场头部效应显著,轻量化模型成为流量主力,价格竞争加剧导致部分模型用量大幅波动。
核心数据与事实
1. 用量规模:四款模型突破10万亿tokens大关
周期内,仅有轻量级(Flash或类Flash架构)模型进入周用量超10万亿tokens的行列,具体数据如下:
- DeepSeek V4 Flash:14.59万亿 tokens
- DeepSeek V4.1 Flash:12.93万亿 tokens
- 腾讯 Hy4 preview:12.01万亿 tokens
- 智谱 AI GLM 5.3 Flash:11.62万亿 tokens
此外,上海创智学院 Nex-N2.5 Pro 和阿里巴巴 Qwen3.8 Flash 首次跻身Top 15榜单。
2. 市场格局:头部高度集中,DeepSeek与混元占比近半
- 第一梯队:上述四款模型在中国大模型词元用量份额中同处第一梯队,合计占比约为 66%。
- 排名变动:DeepSeek于9月10日下调 DeepSeek V4 Flash 及 V4.1 Flash 定价后,后者周用量环比增长 483.62%,排名从第9位跃升至第2位。
- 集中度:前三位模型贡献了近一半的总用量份额,前五名模型占比超过四分之三,显示市场资源向头部模型加速聚集。
3. 价格与性价比分析
- 价格区间:当期Top 15大模型每百万tokens的价格极差为38.75元,与上期持平。最低价为小米 MiMo-V2.5(1.25元/百万tokens),最高价为月之暗面 Kimi K3(40元/百万tokens)。
- 性价比标杆:在基准任务成本测试中,腾讯 Hy3 以 0.308元/基准任务 的成本位居最低。紧随其后的是 DeepSeek V4.1 Flash、MiniMax M3 和 GLM 5.3 Flash,这四款模型被归类为“经济好用”区间,显示出极高的投入产出比。
值得关注
- 降价驱动效应明显:DeepSeek V4.1 Flash 的用量爆发式增长直接关联其价格调整策略,表明在当前市场环境下,价格敏感度是影响用户选择的关键因素之一。
- 轻量化趋势确立:所有超高用量模型均为Flash或类Flash版本,暗示市场对推理速度、成本控制要求较高的场景更倾向于使用轻量化模型,而非追求极致性能的旗舰版。
- 竞争焦点转移:随着头部份额固化,后续竞争可能更多集中在特定垂直领域的性能优化以及更低成本的基准任务解决能力上。
