Anthropic:针对 Claude 5 代模型,Claude Code 移除超过 80% 的 system prompt
Prompt越长越好吗?研究告诉你何时该停手
概述
Anthropic 在 2026 年 7 月 24 日的官方文章中报告:针对 Claude Opus 5、Fable 5 等更先进模型,Claude Code 移除了超过 80% 的 system prompt,其内部编码评测未出现可测损失。被删减的内容主要是三类:跨层重复的要求、已过时的绝对规则,以及可移入 Skill 的专用流程。作者转述时强调可借鉴的是定期检查每条规则是否仍在解决真实问题——模型或工作流升级后旧限制可能失效,同一要求分散在系统指令、Skill 与用户请求中也会变得难以维护;但业务事实、权限边界和验收条件仍须按实际任务保留。原文同时注明这是特定产品与内部评测下的工程观察,不能据此建议所有提示词都删掉 80%。 据正文转述:Anthropic 公布他们为 Claude 5 系列删掉了 Claude Code 系统提示词的 80% 以上,编码评测没有可测量的损失——被删的是其打磨一年多、被数百万开发者每天使用的核心资产。Anthropic《Prompting Claude Opus 5》给出的处置建议是「删除,而不是改写」:如果 prompt 含显式的验证指令(如「给任何非平凡任务加最后一步验证」「用 subagent 去验证」)应直接删除,这类指令在 Claude Opus 5 上导致过度验证,删除后可在质量无损失的前提下减少浪费的 token,同一结论适用于「加了独立验证步骤的 legacy harness scaffolding」;强调语反噬——过去常用的 CRITICAL: You MUST use this tool when... 在新模型上导致过度触发,官方建议降级为普通的 Use this tool when...,If in doubt, use [tool] 一类兜底句现已成为过度触发的主要来源;负面指令反噬——「不要思考/不要推理」类规则要求直接删掉,且点名负面项比笼统表述效果更差。OpenAI 侧给出机制说明:在 GPT-5.5 上,旧 prompt 中过度规定流程的写法会引入噪音、缩小模型的搜索空间或导致机械化回答,迁移建议是从一个全新的最小 prompt 基线起步,而非逐条搬运旧指令。另一项既成事实是 prefill(预填充助手回复开头以强制输出格式,如先塞入 {"result": 逼模型输出 JSON):从 Claude 4.6 开始该能力从 API 层面直接移除,带 prefill 的请求会返回 400 错误。