Anthropic 大幅削减 Claude Code 系统提示词,新模型无需过多约束
Anthropic 发现,在 Claude Opus 5 等新一代强推理模型发布后,旧的提示词工程范式可能已过时。团队删除了 Claude Code 系统提示词中 80% 以上的内容,而编码评估性能未受影响。这表明随着模型能力增强,应减少约束,让模型自行判断。
Anthropic 发现,在 Claude Opus 5 等新一代强推理模型发布后,旧的提示词工程范式可能已过时。团队删除了 Claude Code 系统提示词中 80% 以上的内容,而编码评估性能未受影响。这表明随着模型能力增强,应减少约束,让模型自行判断。
SynthePulse Insight · AI 深度解读
版本 1 · 1 个来源
随着 Claude Opus 5 等新一代强推理模型上线,Anthropic 发现旧的提示词工程范式可能过时甚至起反作用。他们删除了 Claude Code 中 80% 以上的系统提示词,且编码评估无性能损失。这标志着提示词工程正转向“上下文工程”的新范式。
Anthropic 技术团队成员 Thariq Shihipar 在 Claude Opus 5 上线当天发帖,介绍了新一代模型带来的工程趋势变化。Anthropic 发现,对于 Claude Opus 5、Claude Fable 5 这类模型,团队删掉了 Claude Code 系统提示词中 80% 以上的内容,而在编码评估上没有观察到任何可测量的性能损失。
Anthropic 指出,当用户向 Claude 发送消息时,提示词只是模型所获上下文中的一小部分。上下文中的绝大部分内容来自系统提示词、Skills、CLAUDE.md 文件、记忆以及其他来源,这被称为“上下文工程”。无论使用 Claude Code 还是构建自己的 Agent,它都会显著影响最终产出质量。
Anthropic 发现,过去的一些“最佳实践”如今已沦为误区。例如,旧系统提示词中曾包含“写代码时默认不写注释”“绝不要写多段式 docstring”等强硬指令。但新模型判断力更好,无需显式规则也能处理妥当。新写法变为“写出的代码要读起来像它周围的代码:匹配其注释密度、命名方式和惯用写法”。
另一个误区是给 Claude 提供大量使用示例。Anthropic 发现示例反而会把模型约束在某个探索空间里。与其堆砌示例,不如多花心思在工具、脚本和文件的设计上,让参数更具表达力。此外,旧模型中反复强调指令的做法也不再必要,工具的使用说明应放入工具描述而非系统提示词中。
Anthropic 强调“渐进式披露”:在恰当的时机加载恰当的上下文。例如,他们把验证和代码评审拆成独立的 Skills,供 Claude Code 按需调用。部分工具采用“延迟加载”,Agent 必须先通过 ToolSearch 检索出完整定义才能调用。
CLAUDE.md 应保持轻量,简要说明仓库用途,重点记录代码库中的“坑”。高绩效团队控制在 60 行以内,通常绝不要超过 300 行。Skills 被视为轻量级指南,除非极其关键,否则不要过度约束。对于较长的 Skill,应拆成多个文件,分而治之。
在 plan 模式下,Claude Code 曾高度依赖 markdown 格式的计划文件。但 Anthropic 发现,Claude 已能驾驭更复杂的参考材料,如 HTML artifact 和代码本身。一份规格说明可以是一套详尽的测试用例,也可以是另一个代码库中待移植的函数。评分标准(rubric)也是一种参考材料,Claude 可通过动态工作流派生验证者智能体来校验开发者品味。
Anthropic 建议优先选择以代码形式存在的文件作为参考材料,它们能给 Claude 提供清晰、高保真的指令。例如,一份 HTML 设计稿的效果通常好过对设计的文字描述或一张截图。
过去,用户被鼓励用 # 快捷键将内容自动写入 CLAUDE.md 以保存记忆。而现在,Claude 会自动保存与当前工作及用户相关的记忆。此外,Claude Code 如今拥有更多工具,如记忆、artifacts 和 Skills,可创造跨会话加载与共享上下文的新方式。
Anthropic 还推出了 claude doctor 命令,在 Claude Code 中使用 /doctor 即可自动将 Skills 和 CLAUDE.md 文件调整到合适规模,帮助开发者做简化。
本文信息主要来自 Anthropic 技术团队成员 Thariq Shihipar 的公开帖子及机器之心报道。所有具体数字(如 80%、60 行、300 行)均源自该报道,未获第三方独立验证。
模型能力越强,越不需要冗长的规则和示例。提示词工程正转向上下文工程,核心是精简系统提示、渐进式披露、善用 Skills 和参考材料,并让模型自行判断。
主报道
主报道来源
另有 1 个来源报道