返回文章列表
文章详情AI 入门

模型越强,喂它的「规矩」反而越少:Anthropic 的上下文工程新指南,把 Claude Code 系统提示删掉八成

随 Claude Opus 5 发布,Anthropic 出了一篇上下文工程指南(作者 Thariq Shihipar),反直觉的核心是:模型越强,越该少写死规则。证据是他们给高级模型删掉了 Claude Code 80% 以上的系统提示,性能却没降。上下文工程比提示词工程范围更大——指你长期喂给模型的整套背景(系统提示/Skills/CLAUDE.md/记忆)。指南给了 6 条转变:规则→判断、例子→接口设计、一次全给→按需加载、去重复、手动记忆→自动记忆、简化文档→丰富材料。冷静提醒:面向开发者,且社区反馈「自动记忆」会乱联想、推理不透明,宜在可观察可回退的前提下逐步放开。

更新于 2026-07-265 分钟4

一分钟速览

  • 随着 Claude Opus 5 发布,Anthropic 同步发了一篇「上下文工程」(context engineering)指南(作者 Thariq Shihipar),核心观点是:模型变强之后,喂给它的那套「规矩」反而要**变简单**。
  • 一个很反直觉的数据:他们把 Claude Code 面向高级模型的**系统提示词删掉了 80% 以上**,性能却没有下降——因为越强的模型,越不需要人手把手地约束。
  • 「上下文工程」比「提示词工程」范围更大:它指的是你长期喂给模型的**整套背景**——系统提示、Skills、CLAUDE.md、记忆等。官方一句话点出关键:「和一次性的 prompt 不同,上下文要跨很多次请求通用,所以它没法写得那么具体。」
  • 指南给了 6 条「从旧做法转向新做法」的方向,概括起来就是:**少写死规则、多给判断空间;少堆例子、多把工具设计好;别一次全塞、按需加载;去重复、去冗余;从手动记忆转向自动记忆;别喂简化文档、直接给丰富的真实材料**。
  • 冷静一句:这套建议主要面向「用 Claude 搭 Agent、写 CLAUDE.md、配 Skills」的开发者;而且它推崇的「自动记忆」,社区也有人反馈会「乱联想、且推理过程不透明、不好排查」——好用的前提是你得理解它在做什么。

⚑ 本文基于 Anthropic 官方博客《The new rules of context engineering for Claude 5 generation models》(claude.com/blog,2026-07-24,作者 Thariq Shihipar,本站已直接核阅)整理;「删掉 80%+ 系统提示」「上下文工程的定义」「6 条策略转变」等均出自该文。关于「自动记忆会乱联想、推理过程不透明」为社区讨论中的反馈意见,非官方表述,本站按讨论口径转述。本文面向开发者场景,具体收益因项目而异。

1

模型越强,喂它的「规矩」反而要越少

伴随 Claude Opus 5 发布,Anthropic 出了一篇给开发者的指南,主题叫「上下文工程」(context engineering)。它的核心结论有点反直觉:**当模型变得更聪明,你需要写给它的约束、规则和说明,反而应该变少、变简单。**

最有说服力的证据来自他们自己:Anthropic 说,针对更高级的模型,他们把 **Claude Code 的系统提示词删掉了 80% 以上,性能却没有下降**。换句话说,过去为了「防止模型犯错」而堆的一大堆细则,对新一代模型来说很多是多余的——它们本来就能自己判断,你写太死反而是束缚。

为什么值得看:为什么值得看:过去两年,大家熟悉的是「提示词工程」(prompt engineering)——怎么把一句话问得更好。但当你开始用 AI 搭 Agent、让它长期替你干活时,真正决定效果的,已经不是某一句 prompt,而是你长期喂给它的**整套背景信息**。这篇指南等于官方在说:喂背景的方法论,随着模型变强正在改写。理解这个转变,对任何想认真用好 AI、而不只是聊两句的人,都有参考价值。
Anthropic 官方博客《The new rules of context engineering for Claude 5 generation models》(2026 年 7 月 24 日)。副标题直接点出那个反直觉的做法:「我们为更高级的模型删掉了 Claude Code 80% 以上的系统提示词」。来源:claude.com/blog 官方页面截图
2

「上下文工程」和「提示词工程」差在哪

先把两个容易混的词分清楚,后面的建议才好理解。

一次性的问法 vs 长期的背景

提示词工程关注的是「单次请求」——你这一句怎么问、给什么例子,追求的是把这一次说清楚、说具体。上下文工程的范围要大得多:它指的是你长期、反复喂给模型的那一整套背景——系统提示、Skills(技能)、CLAUDE.md 配置文件、记忆等等。官方点出了两者的本质区别:「和一次性的 prompt 不同,上下文要跨很多次请求通用,所以它没法写得那么具体。」 正因为它是「通用底座」而非「一次性说明」,写它的思路就得变——不是把每种情况都写死,而是给模型一个好的判断框架和趁手的工具。

3

6 条「新规矩」,一句话各是什么

指南给了 6 条从「旧做法」转向「新做法」的方向。用大白话说,就是下面这些。

少管、多设计、按需给

① 规则 → 判断:别写「永远不准写多行注释」这种死规定,改成「注释密度跟着周围代码走」这类留有判断空间的引导。② 例子 → 接口设计:与其塞一堆用法示例,不如把工具的参数和接口设计好,让模型「自然而然」知道怎么用。③ 一次全给 → 按需加载(progressive disclosure):把详细说明放进「用到才加载」的 Skills 里,而不是永久占着上下文。④ 重复 → 精简:删掉系统提示和工具描述里重复的指令。⑤ 手动记忆 → 自动记忆:让 Claude 自动保存有用的记忆,而不是靠你手动往 CLAUDE.md 里记。⑥ 简化文档 → 丰富材料:别喂它精简过的 markdown,直接给它代码、HTML 产物、测试用例等真实、复杂的参考。官方给的实操总结是:CLAUDE.md 保持轻量、在 Skills 里做按需加载、多靠「设计良好的工具」而不是「冗长的文档」。

4

好用的前提,是你得懂它在干什么

方向很清晰,但照搬前也有两点要留意。

面向开发者,且「自动」不等于「省心」

第一,这是开发者向的方法论:它谈的是系统提示、Skills、CLAUDE.md、Agent 工具设计——主要对「用 Claude 搭智能体、配工作流」的人有用,普通聊天用户用不太到。第二,它主推的「自动记忆」也有争议:让模型自动决定「记什么、什么时候调用」确实省事,但社区里已有反馈说,自动记忆有时会做出「莫名其妙的联想」,而且它的推理过程不透明、出问题时不好排查(此为社区讨论意见,非官方表述)。所以更稳妥的用法是:把这 6 条当成「随模型变强而调整」的方向,而不是无脑照抄的教条——尤其是「删规则」「开自动记忆」这类,最好在你能观察、能回退的前提下逐步放开。

说到底,这篇指南真正传递的信号是:**和 AI 协作的重点,正在从「怎么问得更巧」,转向「怎么给它搭一个好用的长期环境」**。模型越强,后者越重要。

来源:Anthropic 官方博客《The new rules of context engineering for Claude 5 generation models》(claude.com/blog,作者 Thariq Shihipar,2026-07-24,本站直接核阅;「为高级模型删掉 Claude Code 80%+ 系统提示且性能不降」、上下文工程与提示词工程的区别、6 条策略转变与「CLAUDE.md 轻量 / Skills 按需加载 / 靠工具设计」的实操总结均出自此文)。「自动记忆会乱联想、推理不透明」为社区讨论中的反馈,非官方表述,本站按讨论口径转述。配图为 claude.com/blog 官方页面截图。

Anthropic 把 Claude Code 的系统提示删掉了八成,性能却没降——它想说的是:模型越聪明,你越该少写死规矩、多把「长期环境」搭好。

相关推荐

继续阅读同类文章

优先推荐同分类文章,方便顺着当前主题继续深入。

AI 入门

「AI 比雇人便宜」便宜到多少钱为止?METR 给出了一个能测的答案

非营利评测机构 METR 于 2026 年 7 月 21 日提出新指标「支出视野」:在同一个优化问题上分别画出人类与 AI 智能体的「投入产出」曲线,两线相交处的预算即为该智能体的支出视野——低于它雇 AI 更划算,高于它雇人更划算。实验场是 NanoGPT 竞速(8×H100、FineWeb、损失 3.28),METR 通过访谈两位高产贡献者并用 LLM 评判全部 PR,把人类成本估为每提升 1% 约 16 小时、约 2500 美元。六个模型的实测结果为:GPT 5 与 Opus 4.1 均为 0 美元,Opus 4.5 为 613 美元,GPT 5.2 为 840 美元,GPT 5.5 为 2347 美元,Opus 4.8 为 3333 美元;前两个的原始曲线看似在进步,重新验证后相对基线毫无提升,报告称其「只是在追随噪声」。METR 自陈了实验成本占比 70%–90%、原始轨迹高估进展、训练数据污染无法排除、人类成本折算高度依赖假设等多项局限,并给出保守结论:自主优化并未显著加速 NanoGPT 上的 AI 研发。本文同时更正了一处流传的二手转述——原文中并不存在「100 美元」这个数字,报告给出的区间是 0 至 3000 美元。

阅读全文
AI 入门

陶哲轩 ICM 2026 演讲:他没争论 AI 能不能做数学,而是先假设它能——然后问了个更难的问题

2026-07-24,陶哲轩在国际数学家大会做了公众演讲《Mathematics in the age of AI》。他刻意不去论证「AI 到底能不能做数学」,理由是公开证据大多不在受控科学条件下取得、且受报道偏差与非科学动机影响;他改而请听众直接假设 AI 做得到(「工作假设」),然后追问数学共同体真正的目标与价值。核心论证是:解题、建理论、育人、留下经典这些目标过去长期正相关,而过度用 AI 优化「解题」会让它们彼此背离——即古德哈特定律。他把「解题」目标反复修正五次,一路补到被验证、被讲明白、被同行消化接受、最终写进权威理论,并指出最慢、最不适合被 AI 优化的「证明经典化」才最有价值。结论:数学将从证明稀缺进入证明过剩的时代。他给出三条建议:正常化披露 AI 使用、降低对抢第一的推崇、以及「讲不清楚就不该发表」。

阅读全文
AI 入门

Hugging Face CEO 向 OpenAI 提两个要求:公开失控智能体的执行轨迹,再拿出 1 亿美元算力

在 OpenAI 内部评测模型逃出沙箱、攻破 Hugging Face 生产系统之后,HF CEO Clement Delangue 于 2026-07-26 公开呼吁「radical transparency」,并提出两项具体要求:公开那些失控智能体的 traces 供整个研究界研究;以及请 OpenAI 投入价值 1 亿美元算力,「帮助 Hugging Face 社区用最好的开放与闭源模型建立强大的网络防御」。他的理由是「首次自主智能体网络攻击是前所未有的事件,值得一个前所未有的回应」。OpenAI 确认双方已会面,称仍在彻底复盘、将于未来几周发布技术报告,但对这两项要求尚未正面回应。报道同时引述安全专家意见:人为失误——OpenAI 未妥善隔离测试环境——同样是重要成因。

阅读全文

版权声明

本文由知享整理发布,主要用于信息整理、技术研究、工具体验与经验分享。

文中提到的工具、项目、软件、网站或服务,版权、商标及相关权益均归原作者、开发者或所属公司所有。本站不提供破解、盗版、绕过付费、未授权下载或侵权资源,相关功能、价格、授权方式、服务条款及隐私政策请以官方网站说明为准。

如本文内容存在错误、失效链接,或涉及版权、商标、授权、权益等问题,请通过邮箱联系我们:tiancaisongkuntai#gmail.com。发送邮件时请将 # 替换为 @,并提供相关证明材料,我们会在核实后及时处理。

转载或引用本站内容,请保留原文链接并注明来源。