← 返回新闻列表
InfoQ AI 🗓️ 2026-09-21

刚刚,不靠最强大模型,也能拿全球第一?OceanBase 的 “纯国产组合” 登顶国际 Data Agent 榜

⚡ 一句话看懂:刚刚,不靠最强大模型,也能拿全球第一?OceanBase 的 “纯国产组合” 登顶国际 Data Agent 榜。来源:InfoQ AI。

近日,OceanBase 团队提交的 Data Agent 方案登顶国际数据智能体基准 Data Agent Benchmark(简称 DAB),以 90.62%的准确率位列第一,成为该榜单首个准确率突破 90% 的参评方案。

值得关注的是,这一成绩由国产数据库 OceanBase 基于国产大模型 GLM-5.2 构建,超过多项基于 GPT、Claude Opus、Claude Fable 等海外模型构建的 Data Agent 方案。

本次参评方案内部代号为 Scout,相关能力将融入 OceanBase DataPilot。

(图说:OceanBase 登顶国际 Data Agent 榜单,成为首个准确率突破 90%的参评方案) DAB 由 UC Berkeley EPIC Data Lab 与 Hasura PromptQL 合作推出,评测覆盖互联网/本地生活、金融股票、生物医学、知识产权、企业运营、政务/公共管理、媒体/文娱等多个领域,并涉及 PostgreSQL、MongoDB、SQLite、DuckDB 等多种数据库。

与传统 Text-to-SQL 主要考察 AI 能否将自然语言转换成 SQL 不同,DAB 更关注 AI 进入真实数据环境后,能否从复杂、分散、形态各异的数据中找到正确答案。

一个完整任务中,Data Agent 需要理解数据、选择数据、规划分析路径、完成查询计算,并对结果进行验证,考验的是从“理解数据”到“拿到答案”的完整能力。

也正因此,DAB 考验的不只是底层模型,而是“模型+Agent+数据系统”的综合能力。

模型负责理解和推理,Agent 负责规划和执行,数据系统则要支撑数据发现、关联计算和结果校验。

三者能否协同,直接影响 AI 能不能真正把企业数据用起来。

OceanBase 此次参评方案,正是围绕这一能力构建。

系统通过 DataLens 构建数据画像,识别字段和数据关系;再根据任务复杂程度规划执行路径,完成数据选择、筛选、关联和计算;得到结果后,还会通过证据追踪和答案校验检查计算过程和结果,发现问题时调整方案并重新验证,形成“数据理解—规划执行—验证修复”的闭环。

这也解释了此次 90.62%成绩的含金量:它不是单纯证明国产模型能够完成数据查询,而是验证了国产数据库与国产模型结合后,能够共同支撑复杂的数据分析任务。

在底层模型采用 GLM-5.2 的情况下,OceanBase 方案最终超过了多项采用 GPT、Claude Opus、Claude Fable 等海外模型构建的 Data Agent 方案。

对 OceanBase 而言,这也是其 AI 能力的一次新验证。

🔗 原始来源

如果你要核对细节,可以再看原文: InfoQ AI原文链接