返回信息流
新闻事件
A重点76
InfoQ
1 个来源

Claude Code没有“魔法”:上下文工程与插件设计深度解析

本文基于Daisy Hollman在NDC Copenhagen的演讲,介绍了Anthropic的Claude Code插件设计及其上下文工程原语,并探讨了多Agent工作流的运作方式。文章强调了定制化、钩子机制以及从输入模型到输出用户注意力的转变,反映了编程Agent领域的最新进展。

SynthePulse Insight · AI 深度解读会员精读

Claude Code没有“魔法”:上下文工程如何成为软件工程的新核心

版本 1 · 1 个来源

Anthropic 的 Daisy Hollman 在 NDC Copenhagen 演讲中拆解了 Claude Code 的设计哲学:上下文窗口是有限的盒子,定制化是知识,而上下文工程正在成为软件工程的主要学科。

  • 上下文窗口大小一年来停滞在约100万 token,而模型能力持续增长,迫使工程师必须更聪明地选择放入上下文的内容。
  • 定制化即知识:模型权重冻结后,几乎所有定制都发生在文本层面,程序员最擅长控制文本。
  • Claude Code 的编辑工具本质是查找替换,模型已能完美处理复杂嵌套 JSON,但工具仍原始,存在巨大迭代空间。
展开章节目录上下文窗口:一个有限的盒子

上下文窗口:一个有限的盒子

Daisy Hollman 指出,过去一年模型能力爆炸式增长,但上下文窗口大小基本停滞:第一批100万 token 上下文窗口出现在2024年底,2025年2月最前沿模型是100万 token,现在依然如此。这意味着随着任务复杂化,工程师必须越来越聪明地选择放入上下文的内容。

上下文窗口是模型预测下一个 token 所能看到的一组 token,是定制化的空间。你不能把整个代码库都扔进去,必须遵循“不为你不用到的东西付费”的零开销原则。每一项定制都在和工作空间竞争,前面堆得越多,留给实际任务的空间越少。

KV 缓存带来硬约束:要预测下一个 token,前面所有 token 必须保持一致,导致某些操作成本相差10倍。Cursor 早期在 Cursor Rules 上尝试 LRU 缓存,但很快发现成本高得离谱,说明问题比单纯缓存更微妙。

限时免费

继续阅读完整分析

还有 4 节深入分析和完整结论

加载中

可信度边界

本文基于 Daisy Hollman 在 NDC Copenhagen 的演讲,由 InfoQ 整理,属于二手转述。所有观点和描述均来自演讲者本人,未经独立验证。METR 图表和 Mozilla 数据为演讲中引用,具体细节未核实。

主报道

InfoQ

主报道来源