Context Engineering 是全新的运行时

@harleyfoote_
英语1天前 · 2026年7月27日
336K
169
21
9
25

TL;DR

本文指出 AI 开发的未来在于 Context Engineering 而非复杂的提示工程,强调通过减法和架构准则来构建更可靠的 Agents。

Claude 的下一次飞跃不在于更好的提示词创作,而在于更干净的上下文管道。

提示词不再是产品

Claude 5 上下文工程文章中有用的观点几乎平淡无奇:当你给 Claude 发消息时,提示词只是模型接收内容的一小部分。其余部分由系统提示词、技能、CLAUDE.md 文件、记忆和其他来源拼凑而成。

这就是操作要点。界面看起来仍然像一个聊天框。但实际的机器是一个上下文组装系统。如果你正在使用 Claude Code 或构建自己的 Agent,你真正交付的并不是一个巧妙的指令。而是 一个运行时上下文架构

提示词天才只能带来好看的截图。而上下文纪律才能让系统在多次请求中保持一致行为。不那么光鲜,但更有用。自然,也不那么容易被病毒式传播。

通用上下文比特定提示词更难

提示词可以很窄。用户要求一件事,你引导模型做那件事,然后每个人都假装这个演示就是产品。上下文则不同。CodeBun 的文章清晰地阐述了这一点:上下文是跨多个请求通用使用的,因此它不可能那么具体。

这正是大多数 Agent 构建变得奇怪的地方。团队不断添加指令,因为每次失败都感觉像是缺少了一句话。再多一条规则。再多一个策略。再多一个例子。很快,模型在回答今天的问题之前,就得先游过昨天留下的"伤疤组织"。

难点不在于写出完美的段落。而在于决定什么内容值得默认存在。上下文工程是在不确定性下的策展。你不知道用户的下一个提示词是什么。但你仍然必须决定模型应该携带什么信息去应对它。

Claude 5 改变了压缩算法

研究中一个最尖锐的数据点是:据报道,Anthropic 的工程师从 Claude Code 的系统提示词中移除了超过 80% 的内容,用于 Claude Opus 5 和 Claude Fable 5 等更新的 Claude 模型,而其编码评估性能没有可测量的损失

这并不能证明所有长提示词都是坏的。也不能证明每个工作流都应该在周五之前删除 80% 的指令。请不要把一个评估结果变成一种信仰。我们已经有了太多这样的信仰。

但这确实说明了一个重要问题:随着模型能力的提升,旧的框架可能变成死重。过去帮助旧模型的指令,现在可能会干扰新模型。模型变好了,你的上下文可能也需要变小。

新的操作技能是做减法

大多数人听到"上下文工程",想到的是做加法:更多文件、更多记忆、更多背景、更多工具、更多规则。Claude 5 的教训指向了相反的方向。如果 Claude Code 的系统提示词中的绝大部分内容消失后,并未损害编码评估,那么默认的问题应该从我们还能添加什么? 转变为我们可以安全地移除什么?

这是运行时版本的品味问题。保留那些能持续改善跨多个请求结果的上下文。删除那些仅仅因为某人曾看到一次失败就恐慌性修补系统提示词而存在的上下文。

最好的 AI 操作者将看起来不那么像提示词诗人,而更像是编辑、图书管理员和基础设施工程师。他们将维护 CLAUDE.md 文件、技能、系统指令和记忆,作为一层活生生的上下文。他们会修剪它。他们会测试它。他们会抵制那篇神圣的、没人理解但每个人都害怕触碰的 4000 字指令堆。

Agent 让上下文债务变得昂贵

这一点对于 Agent 来说比对于一次性聊天更重要。研究明确地将上下文工程与 Claude Code 和构建你自己的 Agent 联系起来。在 Agent 中,上下文不是一条单独的消息。它是运行环境的一部分。

糟糕的上下文会产生复合效应。一个模糊的系统规则可能会影响工具使用。一段过时的记忆可能会误导决策。一个塞满东西的项目文件可能会淹没那个唯一重要的指令。用户看到的是一个不稳定的 Agent。而真正的 bug 可能在于上下文栈。

这就是为什么"提示词"这个词太狭隘了。Agent 需要上下文预算、上下文来源和上下文卫生。它们需要决定什么是全局的,什么是任务本地的,什么属于记忆,什么属于文件,以及什么根本不应该被加载。

治理也将推动同一方向

合规性大背景也在发生变化。Gunderson 的 2026 年 AI 法律更新描述了不断变化的治理格局,包括整合 AI 监管的联邦努力、科罗拉多州和加利福尼亚州的新框架,以及欧盟 AI 法案下不断发展的国际要求。欧盟委员会将 AI 法案描述为处理 AI 风险的框架。

这并不意味着每个 Claude 上下文文件突然都变成了监管产物。但这确实意味着 AI 团队将有更多理由去了解他们的系统被告知了什么,这些上下文来自哪里,以及它如何变化。

换句话说:上下文工程不仅仅是性能调优。它是运营控制。获胜的团队不会是那些拥有最复杂提示词的团队。而是那些能够解释、测试和削减其上下文,同时不破坏产品的团队。

关于作者

我是 Harley Foote。我构建能做实事的 AI Agent——并且我努力在重要转变发生时就早早介入。

我全力投入两件事:heyfriday.app —— 一个能学习你品味的个人 AI 购物 Agent;以及 hermesshield.ai —— AI Agent 的安全防护,因为一旦 Agent 能够代表你行动,它就可能受到攻击。

如果你也在 Agent 领域构建,不妨来打个招呼。

heyfriday.app · hermesshield.ai · linkedin.com/in/harley-lewis-foote-850177109

二次创作

使用 YouMind 创作爆款文章

收集素材、拆解爆点、生成视觉资产、撰写内容,并在一个 AI 工作空间里完成分发。

了解 YouMind
写给创作者

把你的 Markdown 变成干净的 𝕏 文章

图片上传、表格、代码块,往 𝕏 上手动重排太痛苦。YouMind 把整篇 Markdown 一键转成干净、可直接发布的 𝕏 文章草稿。

试试 Markdown 转 𝕏

更多可拆解样本

近期爆款文章

探索更多爆款文章