登顶国际Data Agent榜单登顶国际Data Agent榜单,OceanBase超过多项GPT、Claude方案
近日, OceanBase团队提交的Data Agent方案登顶国际数据智能体基准Data Agent Benchmark(简称DAB),以90.62%的准确率位列第一,成为该榜单首个准确率突破90%的参评方案。值得关注的是,这一成绩由国产数据库OceanBase基于国产大模型GLM-5.2构建,超过多项基于GPT、Claude Opus、Claude Fable等海外模型构建的Data Agent方案。本次参评方案内部代号为 Scout,相关能力将融入 OceanBase DataPilot。
(图说:OceanBase登顶国际Data Agent榜单,成为首个准确率突破90%的参评方案)
DAB由UC Berkeley EPIC Data Lab与Hasura PromptQL合作推出,评测覆盖互联网/本地生活、金融股票、生物医学、知识产权、企业运营、政务/公共管理、媒体/文娱等多个领域,并涉及PostgreSQL、MongoDB、SQLite、DuckDB等多种数据库。
与传统Text-to-SQL主要考察AI能否将自然语言转换成SQL不同,DAB更关注AI进入真实数据环境后,能否从复杂、分散、形态各异的数据中找到正确答案。一个完整任务中,Data Agent需要理解数据、选择数据、规划分析路径、完成查询计算,并对结果进行验证,考验的是从“理解数据”到“拿到答案”的完整能力。
也正因此,DAB考验的不只是底层模型,而是“模型+Agent+数据系统”的综合能力。模型负责理解和推理,Agent负责规划和执行,数据系统则要支撑数据发现、关联计算和结果校验。三者能否协同,直接影响AI能不能真正把企业数据用起来。
OceanBase此次参评方案,正是围绕这一能力构建。系统通过DataLens构建数据画像,识别字段和数据关系;再根据任务复杂程度规划执行路径,完成数据选择、筛选、关联和计算;得到结果后,还会通过证据追踪和答案校验检查计算过程和结果,发现问题时调整方案并重新验证,形成“数据理解—规划执行—验证修复”的闭环。
这也解释了此次90.62%成绩的含金量:它不是单纯证明国产模型能够完成数据查询,而是验证了国产数据库与国产模型结合后,能够共同支撑复杂的数据分析任务。在底层模型采用GLM-5.2的情况下,OceanBase方案最终超过了多项采用GPT、Claude Opus、Claude Fable等海外模型构建的Data Agent方案。
过去,数据库主要负责存储、查询和处理数据。随着AI Agent成为新的数据使用者,数据库需要解决的问题也在变化:AI不仅要拿到数据,还要理解数据、关联数据、分析数据,并验证结果是否可靠。AI时代的数据底座,也因此开始从“把数据交给AI”,走向“帮助AI把数据用起来”。
这正是OceanBase从数据库向AI数据平台演进的方向。OceanBase DataPilot是面向AI数据分析场景的产品方向。本次DAB评测以内部代号Scout的方案提交,相关技术能力后续将沉淀到DataPilot产品中,进一步承接数据理解、任务规划、分析执行和结果验证等能力,让AI从“调用数据”走向“用数据完成任务”。
从数据库到AI数据平台,变化的不只是产品形态,更是数据库与AI的关系:过去数据库负责把数据存好、算好、取出来,如今还要帮助AI理解数据、组织数据并完成分析。此次登顶DAB,是OceanBase将数据库能力进一步延伸到AI数据分析环节的一次验证,也意味着数据库正在从AI的数据底座,走向AI的数据工作引擎。
OceanBase以20.2%市场份额居首,中国分布式数据库迈 ...
OceanBase CTO杨传辉WAIC分享:让数据库从人类友好到 ...
第五届OceanBase数据库大赛收官:北邮「编程高手」赛 ...
追觅旗下户外庭院板块将亮相IFA 2026,AI与机器人重构户外多场景应用
WorkBuddy金融版正式发布,让Agent真正进入金融业务现场
腾讯WorkBuddy开放平台上线:首批超百家伙伴入局 国内首个同时打通软硬件、开发者三层生态的Agent基座
百度200万美元重奖2支技术团队,李彦宏:认可技术价值,是百度真正的竞争力