Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.091 — 2026-10-03
NEWS 约 1 分钟

模型路由也会进化:Token消耗号称减半

openJiuwen让模型调度随反馈进化,称可减少逾50% Token消耗。

IMAGE — 量子位

让 AI 翻译一句话,却每次都请最贵、最强的模型出场,就像寄一封信也要调专车。openJiuwen X-Router 想解决这种“用力过猛”:它在 Agent(能调用模型和工具完成任务的 AI 系统)与多个模型之间充当调度员,结合任务难度、模型能力、实时负载和成本,决定这一轮该由谁处理。

它更值得注意的地方,是路由规则不会写死。每次调用后的质量、成败、耗时和成本都会成为反馈,帮助系统调整下一次选择;样本不足或新方案优势不明显时,则保留原判断。团队还把学习状态与决策算法分开:即使状态丢失,系统也只是退回没有历史经验的“冷路由”,不会因此让请求失败。针对多轮 Agent 中工具输出可能挤掉任务信息的问题,X-Router还会特意保留最近一次用户诉求,避免调度跑偏。

据量子位报道,该方案实测可减少超过50%的 Token 消耗。Token 是模型处理文字的计量单位,也是常见计费依据。不过报道未披露测试任务、对照方案及质量变化,因此“省一半”能否在不同业务中复现,仍要看长期任务质量与总成本。


供稿材料 SOURCES — 1

← 返回 2026-10-03 · 科技板块