OceanBase Data Agent方案登顶国际基准,准确率超90%超越GPT/Claude方案
2026/09/21 15:20阅读量 2
OceanBase团队基于国产大模型GLM-5.2构建的Data Agent方案(内部代号Scout),在国际数据智能体基准DAB中以90.62%的准确率位列第一,成为首个突破90%准确率的参评方案。该成绩超越了多项基于GPT、Claude Opus等海外模型构建的方案,验证了国产数据库与国产模型协同处理复杂数据分析任务的能力。相关技术将融入OceanBase DataPilot产品,推动数据库从数据存储向AI数据工作引擎演进。
事件概述
近日,OceanBase团队提交的Data Agent方案在国际数据智能体基准(Data Agent Benchmark, DAB)中登顶,以90.62%的准确率位列第一。这是该榜单首个准确率突破90%的参评方案,且该成绩由国产数据库OceanBase结合国产大模型GLM-5.2构建,成功超越了多项基于GPT、Claude Opus、Claude Fable等海外模型构建的方案。
核心信息
- 评测背景:DAB由UC Berkeley EPIC Data Lab与Hasura PromptQL合作推出。与传统Text-to-SQL仅考察自然语言转SQL不同,DAB更关注AI在真实数据环境中,面对复杂、分散、形态各异的数据时,能否找到正确答案。
- 能力要求:完整任务需涵盖理解数据、选择数据、规划分析路径、完成查询计算及结果验证,考验“模型+Agent+数据系统”的综合协同能力。
- 技术方案:OceanBase参评方案(内部代号Scout)通过DataLens构建数据画像以识别字段和关系;根据任务复杂度规划执行路径,完成数据筛选、关联和计算;并通过证据追踪和答案校验形成“数据理解—规划执行—验证修复”的闭环。
- 行业意义:此次突破不仅证明国产模型具备数据查询能力,更验证了国产数据库与国产模型结合后,能共同支撑复杂的数据分析任务。这标志着数据库角色正从单纯的“数据底座”向帮助AI理解、组织和完成分析的“AI数据工作引擎”转变。
值得关注
OceanBase表示,本次DAB评测的技术能力后续将沉淀到其面向AI数据分析场景的产品OceanBase DataPilot中,旨在让AI从简单的“调用数据”走向真正“用数据完成任务”。
