← 回總覽

【第 3699 期】Karpathy 的 4 条规则让 Claude 出错率骤降,但还不够。Mnimiy 又加了 8 条

📅 2026-05-15 09:03 前端早读课 人工智能 2 分鐘 1608 字 評分: 86
CLAUDE.md AI 编程 Claude Code 提示词工程 Agent 编排
📌 一句话摘要 本文在 Karpathy 提出的 4 条 CLAUDE.md 规则基础上,基于 30 个代码库的实测,补充了 8 条专门应对多步骤 Agent 任务、Token 预算、测试质量等新问题的规则,将 AI 编程出错率从 41% 降至 3%。 📝 详细摘要 文章首先回顾了 Andrej Karpathy 吐槽 Claude 写代码的经典问题,以及 Forrest Chang 据此提炼的 4 条 CLAUDE.md 规则(先想清楚、简洁至上、精准修改、目标驱动),该模板在 GitHub 上获得了 12 万星。作者 Mnimiy 随后在 30 个代码库上进行了 6 周的实测,发现原版

📌 一句话摘要

本文在 Karpathy 提出的 4 条 CLAUDE.md 规则基础上,基于 30 个代码库的实测,补充了 8 条专门应对多步骤 Agent 任务、Token 预算、测试质量等新问题的规则,将 AI 编程出错率从 41% 降至 3%。

📝 详细摘要

文章首先回顾了 Andrej Karpathy 吐槽 Claude 写代码的经典问题,以及 Forrest Chang 据此提炼的 4 条 CLAUDE.md 规则(先想清楚、简洁至上、精准修改、目标驱动),该模板在 GitHub 上获得了 12 万星。作者 Mnimiy 随后在 30 个代码库上进行了 6 周的实测,发现原版 4 条规则在应对 2026 年 5 月涌现的 Agent 编排、多步骤任务、跨代码库协作等新场景时力有不逮。为此,作者补充了 8 条新规则:不让模型干非语言类活、硬性 Token 预算、冲突挑明不折中、先读再写、测试验证意图、设置检查点、遵循惯例、大声报错。实测数据显示,12 条规则将出错率从 41% 降至 3%,且遵循率仅从 78% 微降至 76%。文章还详细分析了原版模板在长时间运行任务、跨代码库一致性、测试质量、生产与原型区分四个场景下的失效原因,并提供了可直接复制的完整 12 条规则模板。

💡 主要观点

- Karpathy 的 4 条规则有效但已不完整,无法应对 Agent 时代的新问题。 原版规则主要解决 2026 年 1 月时 AI 编程的常见错误(如过度工程化、擅自修改无关代码),但对于多步骤 Agent 任务、Token 预算失控、跨代码库一致性等新问题缺乏约束。

新增的 8 条规则聚焦于 Agent 编排、资源管理和质量保障,与原有规则形成互补。 新规则覆盖了模型使用边界(规则五)、Token 预算(规则六)、冲突处理(规则七)、代码阅读(规则八)、测试质量(规则九)、检查点(规则十)、惯例遵循(规则十一)和错误报告(规则十二),填补了原版在流程控制和质量验证上的空白。
CLAUDE.md 文件应保持简洁,超过 200 行或 14 条规则后遵循率会断崖式下降。 Anthropic 官方指出 CLAUDE.md 是建议性的,超过 200 行后重要规则会被淹没。作者实测发现超过 14 条规则后遵循率从 76% 暴跌至 52%,因此规则应精炼且针对真实失败模式。

💬 文章金句

- CLAUDE.md 不是许愿清单,而是一份行为契约 —— 用来封堵你已经观察到的、具体的失败模式。

  • 一份针对你真实失败模式精调过的 6 条规则 CLAUDE.md,胜过一份塞了 6 条你永远用不上的规则的 12 条版本。
  • Karpathy 的 4 条防止的是他在 2026 年 1 月观察到的失败模式……我新增的 8 条防止的是 2026 年 5 月涌现的失败模式。

📊 文章信息

AI 初评:86

来源:前端早读课

作者:前端早读课

分类:人工智能

语言:中文

阅读时间:28 分钟

字数:6947

标签: CLAUDE.md, AI 编程, Claude Code, 提示词工程, Agent 编排

阅读完整文章

查看原文 → 發佈: 2026-05-15 09:03:00 收錄: 2026-05-15 12:00:04

🤖 問 AI

針對這篇文章提問,AI 會根據文章內容回答。按 Ctrl+Enter 送出。