Claude Code 的系统提示词被削减了 80% ?! AI Engineer World's Fair 炉边对谈,Simon Willison 主持,对谈嘉宾为 Claude Code 产品负责人 Cat Wu 和工程师 Thariq Shihipar。 youtube.com/watch?v=uU5Gv2…
对谈中最反直觉的部分是「Claude Code 的系统提示词被削减了 80%」,且这一变化适用于 Fable 5 和 Opus 4.8 及未来的前沿模型。
Cat Wu 和 Thariq Shihipar 给出了几条具体经验
- 删除示例(few-shot examples)反而更好
- 少用"不要做 X"的禁令,多给上下文
- 检验每条指令是否"100% 成立"
- 边界条件:这套做法依赖模型的判断力
- "Claude 提示 Claude,一路到底
对谈中的其他重要内容
Claude Tag(Slack 协作版 Claude):默认多人协作、可主动长期监控(如自动修 bug 提 PR)、带频道级团队记忆。最惊人的数据:Anthropic 产品工程团队 65% 的 PR 已由它落地。分工:复杂任务用 Claude Code 交互迭代,例行任务交给 Claude Tag。
代码审查去人工化:核心区域仍由 code owner 人工把关,外层改动已全交自动审查。信任是花六个多月逐步建立的——每次事故都把肇事 PR 加入评测集,确保审查系统永不回退。
评测是地基:新模型靠跑完整评测集确认"严格优于上代"才能即插即用替换;除能力评测外还在建行为评测(如用户讨厌模型说"该睡觉了")。瓶颈不是评测工具,而是构建高质量评测的技能。
Auto Mode 与安全:内部人人在用。机制是每次工具调用由 Sonnet 分类器结合对话上下文动态判断,并与沙箱联动。声称对提示词注入、数据外泄的风险"远低于人工审查"——评测数据待公布,Simon 持审慎期待。另有凭证注入模式:凭证在请求时动态注入,代理"可用而不可见"。
工程观念翻转:"重写是好事"如今成立——代码库即唯一的 spec,有好测试套件就能放心重写;工程师的价值重心从执行力转向产品品味与商业判断(想法到落地已缩至一周)。
工具设计:趋势是做减法——已移除 grep/glob 改用原生 bash,保持工具少而功能互不重叠。"模型更像生物学而非物理学,工具设计是一门艺术。"
人的价值:面对被模型取代的失落感,答案是用更大的野心对冲——别只把旧工作变成一句提示词,去做以前不敢做的事。文化格言:"我们不和自己谈判",先做,让权衡自己现身。