Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.069 — 2026-09-11
PAPER HF 22 约 1 分钟

Agent的执行流程也能自我进化

把Agent冗长的行动记录整理成会从成败中改写自己的流程图。

让 AI 连续查资料、调用工具、完成一项长任务,就像让人只靠一卷不断变长的聊天记录办事:越到后面,越容易忘记目标、打乱顺序或重复碰壁。Procedural Graphs 的思路,是把这些隐含的做事流程整理成程序图——一种可分岔的流程图,明确“什么条件下做哪一步,接下来能走向哪里”。它保存的是如何做事,而不是知识图谱所保存的事实。

执行时,系统先判断 Agent 当前位于图中的哪个节点,再读取附近几步的连线,为下一步生成针对当前处境的提示。这种提示只引导、不强制,Agent 仍可自行推理。更关键的是,图还能在任务结束后自我修改:一个 LLM 会对照成功与失败的执行轨迹——也就是规划、工具调用及结果的过程记录——补充或删除节点和连线,并改写适用条件、操作建议和常见陷阱。

最值得注意的是它的“验收机制”:候选修改只有在留出的验证任务上保持或提高成绩,才会正式写入;被拒绝的修改也会留下,避免系统反复提出同一种坏主意。作者称,从极简骨架演化出的图可达到或超过人工设计版本,也能修补有缺陷的专家流程;不过材料未给出具体分数。


供稿材料 SOURCES — 1

← 返回 2026-09-11 · 学术板块