Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.023 — 2026-07-27
NEWS HN 433 约 5 分钟

Claude 5重写上下文工程

Anthropic 称删掉 Claude Code 超过 80% 的系统提示后,编程评测未见可测损失。关键变化是少写死规则,按需加载上下文。

IMAGE — Hacker News 高分帖(24h+ 滚动窗口)
Claude 5 重写上下文工程:少写规则,让信息按需出现

你请一位熟悉公司的同事处理项目,不会先塞给他一本包含所有规章、案例和注意事项的厚手册。信息太多,其中几条还互相矛盾,他反而要先猜“到底听谁的”。AI Agent 也有这个问题:任务还没开始,说明书已经挤满桌面。

Anthropic 最近称,它为 Claude Opus 5、Claude Fable 5 等新一代模型删掉了 Claude Code 超过 80% 的 system prompt,内部编程评测没有出现“可测量的效果损失”。system prompt 是产品预先交给模型的高优先级说明,用来规定角色、边界和工作方式。这次变化的重点不是模型参数,而是重新安排模型工作时能看到什么。

这是一份 Anthropic 对自家产品和内部评测的总结,目前只有单一机构信源。所谓“超过 80%”和“没有可测损失”都缺少完整评测数据,适合看作一种值得关注的工程方向,还不能当作独立验证过的结论。

真正要整理的,不只是用户那句话

用户输入的 prompt,只是 Claude 所见信息的一部分。完整的“上下文”还可能包括 system prompt、Skills、CLAUDE.md、memory 和工具返回结果。Skills 是按任务调用的工作说明;CLAUDE.md 通常保存项目约定;memory 则承担跨任务或跨会话的信息留存。

选择、压缩和排列这些材料,就是“上下文工程”。它直接影响 Agent 的正确率、运行成本和长任务稳定性。窗口有限,常驻说明越多,留给当前任务的空间就越少;规则彼此冲突时,模型还要额外判断优先听哪一条。

Anthropic 在内部使用记录里看到过这种冲突:一处要求“适当补文档”,另一处又写着“不要添加注释”。旧规则原本用于避免最坏情况,却可能在新任务里变成束缚。于是,新方案开始从“给 Claude 更多硬规则”转向“让 Claude结合现场判断”。例如,过去会严格限制注释和长文档;现在的原则更接近:让代码匹配现有项目的注释密度、命名和写法。

从“全部塞进去”改成“用到再拿”

第二个变化是少给固定示例,多设计清楚的接口。Anthropic 认为,示例虽然能教模型使用工具,也可能把它的探索范围锁在示例附近。更好的做法,是把工具可接受的参数和状态设计明白。比如 Todo 工具把状态限定为 pendingin_progresscompleted,再规定同时只能有一项处于进行中。接口本身就在表达规则。

第三个变化叫 progressive disclosure,即“渐进式披露”:信息不再全部常驻,而是在真正需要时加载。代码审查和验证说明可以拆成独立 Skill;部分工具采用 deferred loading,也就是延迟加载,Agent 先通过 ToolSearch 找到完整定义,用到时才占据上下文。

同样的思路也适用于 CLAUDE.md 和 Skill.md。它们不必成为收纳所有经验的总仓库,可以拆成一棵文件树,让 Claude 沿任务需要逐层取用。Claude Code 还增加了 memory、artifacts 和 skills 等机制,用于加载信息并在会话之间共享上下文。

为什么这件事值得关注

这代表 Agent 的工程重点正在变化。过去,人们担心模型“不听话”,于是不断增加规则、示例和重复提醒。Anthropic 的判断是,新模型已经能承担更多现场决策;继续沿用旧写法,可能让约束互相打架,也让无关材料长期占用上下文。

说白了,上下文工程开始更像编辑工作:不是把资料堆得越多越好,而是决定哪些内容必须常驻,哪些可以临时调取,哪些规则应该直接体现在工具接口里。若这一方向经独立评测成立,它会同时关系到 Agent 的成本、质量和处理长任务时的稳定性。

局限与未知

  • “删掉超过 80%”没有披露原始与删减后 system prompt 的 token 或字符口径;内部编程评测也没有公开名称、样本量、误差范围和完整成绩。“没有可测损失”不等于能力完全无损。
  • Claude Opus 5、Claude Fable 5 的命名、发布状态和可用范围,在现有材料中没有第二个独立来源支持,因此不能据此推断整个“Claude 5”系列已经全面发布。
  • 材料同时出现 claude doctor;/doctor 两种写法。它据称可帮助调整 Skills 与 CLAUDE.md 的规模,但命令名称和调用方式仍需官方文档进一步核对。

供稿材料 SOURCES — 1
01
The new rules of context engineering for Claude 5 generation models Hacker News 高分帖(24h+ 滚动窗口) · NEWS
原文 ↗

← 返回 2026-07-27 · 科技板块