英伟达开源 SoL-Pi:通过四大核心机制实现工作流自我优化,Token消耗最高降低64%
英伟达开源了基于 Pi 框架改进的 AI 代理工作流优化器 SoL-Pi。该系统通过“自动研究循环”从152个想法中筛选出4个核心机制,旨在解决AI工作流中的冗余和效率问题。实测数据显示,SoL-Pi 相比原生框架可使 Token 消耗最高减少 64%,API 成本下降 50%-54%。
事件概述
英伟达(NVIDIA)近日开源了名为 SoL-Pi 的 AI 代理工作流优化 Harness。该项目基于开源项目 Pi 进行改造,核心理念是让 AI 担任“监工”,对 Agent 工作流中的低效环节进行自动化修复与迭代。通过严苛的筛选机制,英伟达从152个优化想法中提炼出4个核心机制,显著降低了大模型在复杂任务中的资源消耗。
核心信息:四大优化机制
SoL-Pi 的核心优势源于其经过自动化沙盒验证的四个关键机制,这些机制针对 AI 工作流中常见的冗余痛点进行了专项优化:
-
动作融合(Action Fusion)
- 痛点:传统流程中,AI 修改代码后需单独推理是否运行测试,再执行测试指令,产生额外的决策开销。
- 优化:系统将“修改代码”与“运行测试”等固定连续动作合并为一步,省去了中间多余的推理步骤。
-
在线上下文压缩(Online Context Compression)
- 痛点:Transformer 模型的上下文记忆线性累加,导致历史记录臃肿,每次调用都需重新读取大量历史数据。
- 优化:将大任务拆解为小任务,每完成一个小任务即生成精简摘要并保留关键结论。仅在需要核对细节时调取原始记录,大幅减少上下文窗口占用。
-
观察包(Observation Pack)
- 痛点:工具输出的完整结果(如数百行日志)直接塞入上下文,占用大量空间且重复读取成本高。
- 优化:完整输出存储在本地,上下文中仅保留“摘要 + 索引”。AI 如需查看详情,再通过特定指令调取对应段落。
-
证据保存型简化器(Evidence-Preserving Simplifier)
- 痛点:排查错误日志时,主模型需从头阅读冗长日志,造成算力浪费。
- 优化:使用低成本小模型将日志提炼为“诊断报告”,每个结论均对应原文具体位置。主模型仅阅读精简报告,有疑问时再回溯原文,避免“杀鸡用牛刀”。
实验数据与结论
为了验证效果,英伟达构建了包含 535 个可验证环境的测试集,包括 GitHub 真实开源项目的 Bug 修复任务及开放式沙盒探索任务。对比对象包括原生框架驱动的 GPT-5.6 Sol、Claude Opus 5、开源智能体底座 Pi 以及 SoL-Pi。
关键数据表现:
- 对比 Pi 框架:SoL-Pi 消耗的 Token 减少了 45%–49%,开发成本降低约三分之一。
- 对比模型原生官方代理框架:Token 消耗最高骤降 64%,API 价格最多降低 50%–54%。
- 经济效益:在实际开发场景中,每小时可为企业节省 8.75 到 13.5 美元。
核心结论:
英伟达提出“Efficiency for efficiency”(效率即效率)的概念,认为提升工作流效率本身也是一种 RSI(Reinforcement Learning from Self-Improvement)。与其盲目追求让 AI 更聪明,不如先让其干活更有效率。省下的预算可用于更多实验,从而加速 AI 能力的泛化。这四大机制揭示了 AI 工作流的普遍通病,具有跨模型和任务的通用性。
