实测DeepSeek-V4-Pro对比Kimi K3:速度占优,完成度稍逊
2026/08/13 23:23阅读量 1
DeepSeek-V4-Pro正式版发布并涨价,实测对比Kimi K3显示:DeepSeek响应速度快、性价比突出,但Kimi在视觉还原、物理仿真等复杂任务完成度更高。双方基准跑分各有优势,未出现全面碾压。
事件概述
8月12日晚,DeepSeek-V4-Pro正式版(版本号0813)先在API端静默上线,随后于8月13日登陆APP、网页端和API。该版本延续1M上下文、384K最大输出规格,新增low、high、max三档思考强度,并原生支持Responses API,能力侧重Coding、Agent与复杂任务执行。
核心信息
1. 定价调整
自8月17日起,DeepSeek API采用峰谷定价:每日9:00-12:00、14:00-18:00为高峰时段,其余为空闲时段,空闲价格为高峰的一半。DeepSeek-V4-Pro空闲时段缓存未命中输入/输出价格分别为4.5元/百万token和13.5元/百万token,高峰时段为9元和27元,较此前3元和6元明显上涨。
2. 基准跑分对比
与上个月发布的Kimi K3相比,DeepSeek-V4-Pro正式版在自动化、安全及部分高难任务上占优,Kimi K3在长程软件工程和连续任务执行领域领先,双方未出现一方全面碾压的情况。
3. 实测表现
- 内容创作:DeepSeek故事叙事更流畅,但仍有“AI味”;Kimi行业报告信息整理更完整,附带来源和对比表格。
- 编程任务:前端网页实现两者接近;截图还原网页时,Kimi更精准,DeepSeek仅抓住色调未还原结构。3D游戏任务中,Kimi视觉细节和物理表现更好,DeepSeek二次修改速度更快(约5分钟 vs Kimi的10分钟)。
- 视觉审美:用Three.js还原水母湖场景,DeepSeek首次运行空白、渲染错误,成品中水母被处理成灰色椭圆,理解偏离要求;Kimi一次成功,较好呈现“金色星河”效果。
- 物理仿真:鞭炮箱子3D连锁爆炸演示中,Kimi逻辑连贯、无穿模,约10分钟完成;DeepSeek约40分钟,存在穿模、缺少火源过渡、交互逻辑未区分等问题。
值得关注
DeepSeek涨价后“绝对低价”优势弱化,但相比同类旗舰模型仍有性价比。团队方面,深度求索6月启动大规模招聘,并开设Agent基础设施相关岗位;8月13日发布DeepSeek Harness开发者预览版并开源,侧重搭建开放Agent运行框架。公司已完成首轮超500亿元外部融资,并继续推进新一轮融资。后续看点在于涨价后能否维持高性价比,以及能否推出面向终端用户的Agent产品接入真实工作流。
