你请一位新同事修改老项目,他若只搜索几个关键词,很容易漏掉真正的牵连:一个接口改了,数据库字段、说明文档和另一处调用可能都要跟着变。编码 Agent——能自主查找、修改和检查代码的 AI 工具——也有同样的问题。项目一大,它一次能看到的上下文有限,难点不再是“会不会写”,而是能否先找对资料。
Graphify 想给它一张项目地图。这个开源工具一天新增 840 星,可以把代码、文档、PDF、图片和视频整理成可查询的知识图谱——一种由“节点”和“连接”组成的网络。函数、文件或概念可以成为节点;调用、导入和引用则成为连接。Agent 不必每次从头翻文件,而能先问:这个类被谁使用?某段代码和哪份设计说明有关?两个概念之间经过哪些环节?
以下功能、演示和测试数字均来自 Graphify-Labs 自有仓库,尚无独立信源交叉验证。
它不是给文件再做一次搜索
常见的代码库索引,会预先整理文件、符号和引用关系,让工具更快定位内容。Graphify 往前走了一步:它不使用 embeddings——把文本转换成便于比较的数字表示——也不依赖 vector store,即保存这些数字、按相似度检索内容的数据库。它直接生成一张可以沿连接遍历的图。
区别可以这样理解:相似度搜索像在档案室里找“措辞相近”的材料;图谱则像查看人物关系表,追踪谁调用谁、哪份文档解释哪段代码。前者擅长找相似内容,后者强调明确关系。Graphify 提供 query、path 和 explain:分别用于按自然语言取出局部图、寻找两个节点之间的路径,以及解释某个概念及其连接。
代码部分由 tree-sitter AST 解析。AST,即抽象语法树,是程序经过结构化拆解后的表示,能区分函数、调用和导入等成分。官方称这一步确定性执行,不调用大语言模型,代码也不离开本机。文档、PDF、图片和视频不同:它们需要语义处理,可能使用 AI 编程助手自带的模型,或用户配置的 API key。因此,“本地运行”只适用于代码解析,不能扩展成所有资料都不会外传。
关键不只是连线,还要说明线从哪来
图谱很容易画得热闹,真正的问题是每条线是否可信。Graphify 把连接标为 EXTRACTED 或 INFERRED:前者表示关系在来源中明确存在,后者表示由工具解析推得。
仓库把它们称为“confidence tag”,即置信标签。但这不是一个数值化的可信度评分,更接近关系的来源类型。它至少让使用者知道,某条边是直接读到的,还是系统推出来的;至于推断是否正确,仍需回到原始材料核对。
运行后,Graphify 会在 graphify-out/ 目录生成三个文件:可在浏览器中点击、筛选和搜索的 graph.html,汇总重点概念与建议问题的 GRAPH_REPORT.md,以及保存完整图结构、供后续查询的 graph.json。官方称它支持 Claude Code、Cursor、Codex、Gemini CLI、GitHub Copilot 等 15 个以上的平台。
为什么编码 Agent 需要这张地图
模型的“上下文”,就是它当前一次任务能看到的指令、代码和资料。项目变大后,把所有文件一股脑塞进去既不现实,也不能保证它注意到关键关系。Graphify 的价值主张,是让 Agent 先查询一张压缩过的项目结构图,再决定该读哪些原文。
这对混合资料项目尤其直观。数据库 Schema——表、字段、类型及其关系的结构说明——若与代码和文档一起入图,Agent 就可能沿着关系追踪某个字段被哪些程序读写,而不是只凭名称猜测。设计说明、注释和代码引用也可以成为图中的一等节点。
官方以 FastAPI 代码库演示:APIRouter 节点有 47 条连接;从 FastAPI 到 ModelField 的最短路径为 3 跳,也就是经过三段关系抵达。它展示了图查询的形态,但仓库没有给出对应版本、提交号和配置,不能把这两个数字当成普遍效果。
仓库还公布了记忆检索基准:在 LOCOMO 的 300 个样本上,Graphify 的 recall@10 为 0.497,高于页面列出的 mem0 0.048 和 supermemory 0.149;但其问答准确率为 45.3%,低于 supermemory 的 49.7%。在 50 个 LongMemEval-S 样本上,问答准确率为 76%,与 dense RAG 持平。官方称各系统使用相同模型、预算和测试框架,两名评判者的一致率为 90.6%。这些是项目方自测,且属于记忆基准,不能直接证明它修改真实代码更准确。
局限与未知
INFERRED连接没有公开正确率评测;标签能提示来源,却不能替代人工核验。- 项目仍处于 public v1 发布前的 early access 阶段,平台入口已经开放,但持续更新和稳定性尚待观察。
- 安装包名是双写
y的graphifyy,项目名和命令则是graphify,刊发或安装时需要特别核对。
Graphify 眼下最值得关注的,不是它是否已经能替人读完代码,而是它把编码 Agent 的瓶颈重新表述清楚了:动手之前,先建立一张可追问、可追溯的项目地图。至于这张地图有多完整、推断有多准,以及能否稳定减少改错代码,现有材料还不足以下结论。