拆解Anthropic:模型与产品如何协同演进,让coding先吃到复利?

2026/08/20 17:05阅读量 2

截至2026年7月底,Anthropic年化营收运行率突破650亿美元,二季度营收超115亿美元并首次营业利润转正。其增长关键不在于单点模型能力,而在于以技术产品经理、eval化产品目标和原型文化构建“co-design loop”,让Claude Code、Cowork等产品持续承接模型能力并反哺模型迭代。

事件概述

据彭博社报道,截至2026年7月底,Anthropic年化营收运行率已突破650亿美元,较2025年底约90亿美元的水平增长超7倍。2026年二季度初步收入超过115亿美元,同比增幅达14倍,并首次实现营业利润转正。文章认为,模型能力不会自动转化为收入,Anthropic的关键在于通过产品与模型的协同演进,将前沿能力快速变成可用的商业化产品。

核心机制:技术产品经理与eval

Anthropic内部设有连接研究与产品两个领域的特殊岗位。其首位技术产品经理Dianne Penn的职责,是从模型研究团队和产品实验室Labs之间找到交叉点,管理模型能力快速变化带来的不确定性。

2023年7月Claude 2上线后,用户频繁抱怨“不遵循指令”。团队在阅读用户授权分享的失败轨迹后发现,早期这类投诉中约80%指向一个具体问题:Claude无法稳定输出正确的JSON。团队从真实失败中收集30—40个案例,写成可重复运行的eval,之后每一代模型都要重新测试。目前这组评测通过率已接近99.9%—100%,JSON格式遵循不再是主要投诉。

Dianne提出“Evals are the new PRDs”:传统PRD无法精确定义概率系统的行为,eval则把产品目标变成可测试的输入、理想输出和通过条件,使研究、产品和发布团队拥有共同尺度,也让产品愿景进入研究训练管线。

Coding如何成为战略重点

2023年末,用户行为发生明显变化:不再只是要求补全代码,而是让Claude一次生成更长、更完整的代码,甚至把整段编码任务交给模型。Anthropic据此将长代码生成提升为Claude 3系列及后续模型的重点能力方向。

2024年3月Claude 3 Opus发布,coding开始成为Claude区别于其他模型的用户认知。2024年6月Claude 3.5 Sonnet发布,官方披露其内部agentic coding评测成绩从38%提升至64%,模型角色从代码生成器转向软件工程协作者。但用户仍要手动搬运上下文、复制结果、执行命令,文章将这一阶段称为“product overhang”——模型能力已有,产品形态尚未跟上。

产品落地:Claude Code与Cowork

Claude Code最初是Boris Cherny为熟悉Anthropic公开API而写的终端聊天程序,后来加入bash和文件编辑能力。原型在内部分享后迅速传播,日活曲线近乎垂直增长,创始人Dario曾追问团队是否在强迫员工使用。用户自发行为被产品化:有人用Markdown文件记录项目规范,后成为CLAUDE.md;有人要求先讨论思路再写代码,后发展为Plan mode。2025年2月,Claude Code以研究预览版推出,既是产品,也是收集真实工作流反馈的研究工具。

Cowork是面向非程序员用户的通用知识工作Agent,直接复用Claude Code的agent harness并组合多个内部组件,由一小队工程师在10天内完成开发。它的快速成型并非凭空发生,而是此前一年多积累的模型能力、Claude Code的Agent能力、各团队原型和基础设施都已就位,团队只是在能力与需求同时越过阈值时收拢成产品。

下一代模型规划与Co-design Loop

Anthropic不按具体版本和功能规划路线图,而是先设想Claude最终能承担某项工作的远景场景,再拆解为视觉识别、语言理解、工具调用、错误恢复等能力轴。产品、工程和研究团队共同判断当前模型的能力缺口,再决定是补数据、开展强化学习,还是回到更底层的研究。

技术研究产品经理Alex Albert用“培养”形容模型打造过程:模型不是按图纸组装的功能,而是在训练环境、反馈信号和约束条件下成长的复杂系统。因此,技术产品经理需在模型构思阶段就进入流程,并在训练开始前参与定义“模型需求”。

Anthropic内部推崇“原型文化”,研究、销售、招聘等非产品岗位也会主动搭建工具原型。真实使用带来的反馈规模远超人工处理能力,团队如今会用Claude分析关于Claude的反馈:先让模型对大量反馈分组聚类,找出反复出现的主题,再抽象为可诊断的失败类型。这个“让模型帮助分析模型”的循环,仍需产品经理和研究人员对最终路线作出判断。

这一协同循环也在其他AI公司出现:姚顺雨加入腾讯后推动模型与产品Co-design,Hy3在WorkBuddy首发上线后,自选模型用户中选择Hy3的占比达到60%;xAI则通过Cursor补上真实任务入口,跑通开发者反馈、模型训练与产品验证的闭环。

结论

Anthropic的增长并非孤立的模型能力突破,而是通过技术产品经理岗位、eval化的产品目标、原型文化和跨团队协作,让模型与产品在同一co-design loop中共同演进。这套循环的转速,正在成为AI公司竞争的下一个分水岭。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。