你问 AI“哪些门店销量下滑、可能是什么原因”,它不能只写一条查询语句,还要找到分散的数据、决定怎么算,并检查答案有没有出错。Data Agent(数据智能体)做的正是这套完整工作。近日,据 InfoQ 报道,OceanBase 团队的方案 Scout 在国际基准 Data Agent Benchmark(DAB)中以 90.62% 的准确率排名第一,也是该榜单首个突破 90% 的参评方案。
Scout 采用国产数据库 OceanBase 和国产大模型 GLM-5.2。它先用 DataLens 梳理字段及数据关系,再规划数据筛选、关联和计算步骤,最后追踪证据、校验答案;发现问题后,还会调整方案并重新验证。DAB 涵盖多个行业,并涉及 PostgreSQL、MongoDB、SQLite、DuckDB 等不同数据库,考察的不只是 Text-to-SQL——把自然语言翻译成 SQL 查询——而是从理解数据到交付答案的全流程。
这次成绩值得关注,因为它显示数据库厂商正在从“存好、查好数据”向自动分析层延伸。相关能力计划融入 OceanBase DataPilot。不过,榜单成绩仍会受题目覆盖、评分方法和运行配置影响,尚不能直接等同于真实企业环境中的普遍表现。