Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.091 — 2026-10-03
NEWS HN 114 约 1 分钟

编码Agent开始自动选模型

Weave Router 2.0按任务自动选模型,自称以约一半成本追平Astra。

IMAGE — Show HN 高分帖(新项目发布流)

让编码 Agent 改个按钮颜色和排查复杂故障,都调用同一个大模型,就像所有病症都挂专家号:能做,但未必划算。开源项目 Weave Router 2.0 提供了一个模型调度层,接在 Claude Code、Codex 等编码 Agent 与多个大模型之间,按任务动态分流。简单的前端修改可交给 Deepseek v4 Flash,棘手调试或系统设计则交给 Astra。

真正难的是选择路径。一场典型编码会话约有 100 次模型调用;若每次可选 10 个模型,理论上就有 10100 条路径。团队没有逐一试错,而是先用隐马尔可夫模型(HMM——根据前后过程推断会话所处状态)追踪任务如何走到当前一步,再由分类器把它归入少数几个候选模型组。作者称,这次改造是性能提升最大的来源,因为仅看眼前内容相似的两个任务,来路可能完全不同。

作者自述,在 Terminal Bench 4.0 和 SWE Atlas 两项编码基准中,路由器通过率与 GPT-6 Astra 相当,成本分别为其 52% 和 54%,速度快 2.2 倍和 2.5 倍。它还会计算切换模型导致缓存重建的代价,避免省下调用费、却花更多钱“重新热身”。这些结果目前来自项目方测试,但它指向一个值得留意的新竞争层:编码 Agent 不只比谁会用工具,也开始比谁更会挑模型。


供稿材料 SOURCES — 1

← 返回 2026-10-03 · 开源板块