百度搭子追赶WorkBuddy:办公Agent竞争不能只拼“干活”
2026年办公Agent成为中美科技公司竞争焦点,国内跑出规模的是腾讯WorkBuddy和百度搭子。腾讯凭社交关系网推动Agent冷启动,百度则试图将搜索、百科、文库等资产转化为证据链,解决Agent结果可信问题。当前市场格局未定,7月中国PC端AI办公产品月活超3000万。
事件概述
2026年,办公Agent成为中美科技公司共同押注的方向。微软围绕Microsoft 365整合Copilot Cowork、Office Agent及Agent 365;Google的Workspace Studio将企业SOP变成可复用Agent流程;OpenAI于7月发布ChatGPT Work。国内跑出规模的是更接近Claude Code的独立Agent——腾讯WorkBuddy和百度搭子(DuMate)。
核心信息
-
办公任务中模型与Harness差距不大:7月23日腾讯发布WorkBuddy Bench,将七个头部模型放入CodeBuddy Code和Claude Code两套Agent Harness,完成代码、网页、办公、安全四类共260项任务。办公是表现最稳定的一类:在CodeBuddy Code环境中七个模型得分在77.47—82.37之间;换一套Harness,五个模型得分变化不到2分,中位绝对变化0.86分。说明“能把事情做出来”正接近普遍基础能力。
-
百度财报数据:百度Q2 AI应用季度收入25亿元,同比增长3%;6月搭子企业版上线;百度文库和网盘AI DAU渗透率同比增长27.4%。
-
百度搭子增长:3月正式推出DuMate,定位桌面级办公Agent;截至8月7日个人版已推进至v1.0.67,期间增加网页发布、内嵌浏览器、远程任务和自动化模板等能力。8月12日百度披露,上线以来日均提问次数增长60倍,近一个月又增长两倍。
关键竞争逻辑:第一项任务与可信验证
Agent比Chatbot更需要用户教育,用户面临“该把第一件真实任务交给它”的问题。微软研究人员对内部数万名工程师使用Claude Code和GitHub Copilot CLI的数据分析显示,第一次使用主要沿着社交网络传播(first use spread primarily through social networks),建议企业推广Agent时让用户看到身边同事实际使用(visible peer use)。腾讯WorkBuddy支持从微信、企业微信、QQ、钉钉、飞书等入口远程下发任务,具备适配Agent冷启动的关系网资产。
百度搭子则面临不同局面:搜索可带来需求,但难以短期再造微信式人际关系网。因此百度需要换一道题——证明Agent干完活后用户可以少检查一遍,把搜索、专业内容和知识体系转化为证据链。
搜索资产必须变成证据链
Agent执行链条越长,早期错误被放大的空间越大。ACL 2026多项研究仍聚焦RAG场景幻觉检测,即便检索到材料,模型生成时仍可能偏离证据。同时GEO(生成式引擎优化)使内容生产者主动研究如何被ChatGPT、Gemini等生成式搜索引用,信息来源筛选更难。
百度将搜索能力做成内置Skill:3月发布搭子时即内置搜索;4月27日千帆将百度搜索、百度百科、深度研究、智能PPT生成封装为标准Skills,百度搜索负责实时网页与资讯检索,百科提供结构化知识。百度文库和网盘补充专业文档与私人文件。搜索侧已有多源比对、信源身份核验、多源交叉验证等流程,但百度仍需解决两个问题:
- 证明最终生成内容与信息源之间的具体关系,例如市场规模数字应回到原始报告具体位置,财务数据回到年报而非转载,政策文件连接政府原文并显示时效;来源冲突时应暴露差异而非静默选择。
- 将搜索、百科、文库、网盘等不同类型数据产品化,在结果中区分内部文件、公开网页、企业公告、媒体报道等多源信息,让用户感知资产价值。
真正的“可信”可能分层:普通创作追求速度,行业研究增加引用,金融、法律和重要决策进入更严格证据模式。
市场格局
7月中国PC端AI办公产品月活刚超3000万:WorkBuddy超1100万,百度搭子约670万,TraeWork等仍在迭代。市场尚未定型,第一阶段已显示不同公司优势:腾讯最容易兑现关系,百度则需将搜索排序变成信源选择,把百科和文库变成证据等级,回答“机器为什么相信这份资料,以及人为什么可以相信机器”。
