DeepSeek V4 Pro与Grok 4.6密集发布,大模型性能、价格、速度“不可能三角”被撕开
DeepSeek V4 Pro与Grok 4.6在约两小时内相继发布,二者均逼近Claude Fable 5的综合表现。DeepSeek V4 Pro以极低API定价和接近Fable 5的Agent/工具调用能力拉低准旗舰门槛,Grok 4.6则以接近旗舰的性能、极快开发速度和订阅额度冲击现有定价体系。文章判断,性能、价格、速度的不可能三角已被打破,夹在中间的大量模型将加速失去用户价值。
事件概述
2026年8月13日凌晨,DeepSeek V4 Pro正式版与Grok 4.6在约两小时内相继发布。两款模型分别为1.6T参数和1.5T参数级,发布后均被指逼近Claude Fable 5的体验水平。相关体验文章认为,这打破了此前大模型在性能、价格、速度上难以兼顾的“不可能三角”,并把行业竞争门槛大幅推高。
核心信息
-
DeepSeek V4 Pro 定位“准 Fable 级”Agent 模型:Terminal Bench 2.1 得分 87.9,Claude Fable 5 为 88.0;预览版为 72.1。DeepSWE 软件工程评测得分 62.7,Fable 5 为 70.0,较预览版 12.8 大幅提升。
-
DeepSeek V4 Pro 当前 API 定价:百万输入 Token 0.43 美元,百万输出 Token 0.87 美元,缓存命中输入仅 0.0036 美元;相比 Fable 5 的输入 10 美元、输出 50 美元,输入价格约为后者的 1/23,输出价格约为 1/57。短板是纯知识/推理仍差十余分、复杂全栈任务仍落后、不支持多模态,开发速度一般。
-
Grok 4.6 API 起步价:百万输入 Token 2 美元、输出 6 美元,分别约为 Fable 5 的 1/5 和 1/8.3。综合性能接近 Fable 5,在财务模型、PPT、法律案件等真实任务上表现不弱,但在开发与 Agent 能力上仍不及 Fable 5。
-
Grok 4.6 的速度表现突出:实测多数开发任务在 20 分钟内完成,部分 3 分钟结束;300 美元 SuperGrok Heavy 订阅高强度使用 4 小时仅消耗约 2% 周额度,并附赠 Cursor Ultra 会员额度。
值得关注
DeepSeek V4 Pro 用极低价格提供了接近 Fable 5 的 Agent/工具调用能力,Grok 4.6 则用接近旗舰的综合性能和极快速度冲击现有定价与订阅体系。二者同时出现后,性能、价格、速度三项均无法与之竞争的中间层模型将很难再靠单一优势维持用户价值,行业“斩杀线”被明显前移;Grok 4.7 也被预告将超越所有模型。
