Claude Code没有“魔法”:上下文工程与插件设计深度解析
本文基于Daisy Hollman在NDC Copenhagen的演讲,介绍了Anthropic的Claude Code插件设计及其上下文工程原语,并探讨了多Agent工作流的运作方式。文章强调了定制化、钩子机制以及从输入模型到输出用户注意力的转变,反映了编程Agent领域的最新进展。
本文基于Daisy Hollman在NDC Copenhagen的演讲,介绍了Anthropic的Claude Code插件设计及其上下文工程原语,并探讨了多Agent工作流的运作方式。文章强调了定制化、钩子机制以及从输入模型到输出用户注意力的转变,反映了编程Agent领域的最新进展。
SynthePulse Insight · AI 深度解读会员精读
版本 1 · 1 个来源
Anthropic 的 Daisy Hollman 在 NDC Copenhagen 演讲中拆解了 Claude Code 的设计哲学:上下文窗口是有限的盒子,定制化是知识,而上下文工程正在成为软件工程的主要学科。
Daisy Hollman 指出,过去一年模型能力爆炸式增长,但上下文窗口大小基本停滞:第一批100万 token 上下文窗口出现在2024年底,2025年2月最前沿模型是100万 token,现在依然如此。这意味着随着任务复杂化,工程师必须越来越聪明地选择放入上下文的内容。
上下文窗口是模型预测下一个 token 所能看到的一组 token,是定制化的空间。你不能把整个代码库都扔进去,必须遵循“不为你不用到的东西付费”的零开销原则。每一项定制都在和工作空间竞争,前面堆得越多,留给实际任务的空间越少。
KV 缓存带来硬约束:要预测下一个 token,前面所有 token 必须保持一致,导致某些操作成本相差10倍。Cursor 早期在 Cursor Rules 上尝试 LRU 缓存,但很快发现成本高得离谱,说明问题比单纯缓存更微妙。
本文基于 Daisy Hollman 在 NDC Copenhagen 的演讲,由 InfoQ 整理,属于二手转述。所有观点和描述均来自演讲者本人,未经独立验证。METR 图表和 Mozilla 数据为演讲中引用,具体细节未核实。
主报道
主报道来源