DeepSeek梁文锋与智谱唐杰的AGI路线之争:摸高 vs 摸奖
2026/07/25 14:07阅读量 3
智谱唐杰和DeepSeek梁文锋在AGI发展路径上出现根本分歧:唐杰提出“摸高计划”,计划两年百亿投入,沿现有工程路线逐步攻克持续学习等难题,力争登顶;梁文锋则认为现有路线存在科学断层,主张“摸奖”式分散探索,等待突破性思路。双方均否定基础模型商品化的判断,但在开源动机、商业变现优先级和实践路径上截然对立。
事件概述
智谱创始人唐杰与DeepSeek创始人梁文锋近期分别发表内部信和投资者讲话,公开了二人在AGI(通用人工智能)实现路径上的核心分歧。唐杰宣布启动为期两年的“Touch High(摸高)计划”,投入百亿级资金,明确四大研究方向,暂不追求短期变现;梁文锋则主张不设传统KPI,让研究员自主探索,他称之为“摸奖”。
核心信息
- 基础模型价值判断:两人均不认同“基础模型已商品化,差距不大”的观点。唐杰认为下一次模型升级将重写所有产品和商业模式,智谱上市后将全面回归基础研究;梁文锋将DeepSeek的商业收入视为AGI探索的副产品,不打算短期增收。
- 下一代模型首要目标:两人一致认为,下一代模型首先应帮助研发团队更快迭代下一版模型,形成自我训练闭环。但这个闭环需要“持续学习”能力——模型在工作中不断积累经验,目前全球尚无一家实现。
- 路径对立:唐杰认为记忆、持续学习、自我评判三大难题正沿现有路线(更长上下文、外部检索、模型周期性更新)逐步消解,因此可以制定连续工程计划。梁文锋则指出“模型每隔两个月发布新版”不等于“同一个模型在工作中成长”,他认为两者之间存在尚未被跨越的科学断层。
- 开源路线差异:梁文锋称DeepSeek从一开始就将最强模型(V3、R1)全开源,而智谱此前仅开源小版本,直到2024年6月才以MIT协议开源旗舰模型GLM-5.2,有种“被迫”的感觉。DeepSeek敢于全开源的原因在于其推理优化绑定工程团队,第三方部署成本高于调用API;同时DeepSeek坚持低定价(十个月回本),使开源成为护城河。
- 前景对比:“摸高”路线两年内必有可量化的阶段性交付物,但一家万亿市值上市公司暂停变现投入基础研究本身就反直觉。“摸奖”路线若两年内无突破可能看不到范式级成果,但一旦做通就是跨越式突破,类似DeepSeek R1的诞生。
值得关注
- 业内预计2024年下半年将出现4~5个接近海外顶级水平的国产Coding模型,当前AI写代码能力的领先很难持续,真正的壁垒在于持续学习、自我训练、长期记忆等未突破的能力。
- 唐杰的“摸高计划”涉及长程Agent、多智能体、完全自我训练和机械可解释性四大方向,但3万亿参数级别训练基础设施仍在补齐。梁文锋则坚持集中力量,将视频生成、世界模型、具身智能等排在后面。
