2026/10/7 15:16:20

Fable Method的14种AI Agent失败模式完整清单:一张「症状→预防步骤」对照表

Fable Method的14种AI Agent失败模式完整清单:一张「症状→预防步骤」对照表 Fable Method的14种AI Agent失败模式完整清单一张「症状→预防步骤」对照表【免费下载链接】fable-methodThe Fable Workflow: how Claude Fable 5 worked, distilled into skills any model can run, with the eval that keeps it honest. Think / act / prove.项目地址: https://gitcode.com/gh_mirrors/fa/fable-methodFable Method是从 Claude Fable 5 蒸馏而来的一套 AI Agent 工作流技能think / act / prove想清楚、动手、给证据。它最有价值的资产之一是把14 种最常见的 AI Agent 失败模式逐一映射到「症状 → 防止它的步骤」的完整对照表。读完这篇指南你就能看懂 AI 编程助手为什么会翻车以及如何用一张表把它们提前拦住。为什么你需要一张「AI Agent失败模式清单」AI Agent 最臭名昭著的失败不是能力不够而是声称成功了却根本没验证。在真实项目里你可能会遇到这些场景你问为什么这里报错Agent 没回答却直接改了 5 个文件你说修好这个失败的测试Agent 默默改对了的代码去迁就一个本身写错的测试它反复重试同一个修复方案 20 次烧完时间和 token最后给你一个应该可以了。这些都不是玄学而是可预测、可预防的固定模式。Fable Method 把 14 种模式全部写进了 failure-modes.md每一种都标注了外面看起来是什么症状、由循环中的哪一步负责拦截。这份表还能被/fable-method audit命令直接调用用来给 Agent 的转录记录打分。3分钟看懂 Fable Method 七步循环读懂对照表的前提对照表里的预防步骤都指向同一个七步循环先用 30 秒过一遍完整规则见 SKILL.md步骤名称一句话说明0分类请求这是提问、任务还是该先出方案问句就绝不改文件1定义完成动手前就说清怎样算做完、用什么可观察的方式验证2收集证据并行查一手资料读窄一点不靠记忆编 API3决策并承诺只给一个推荐方案备选各占一行4外科手术式行动最小正确修改照现有风格多步任务先列清单5观察式验证跑出来看输出目标周边系统两头都查重试硬上限 3 轮6结果优先汇报第一句先说结果诚实标注没验证到的部分14种AI Agent失败模式 × 预防步骤完整对照表这就是主角 下面这张表完整收录了 14 种失败模式按循环步骤分组。遇到左边症状查右边就能找到对应的防线。 第 0–1 步动手之前失败模式 1–4#失败模式外部症状预防步骤Fable Method1擅自开修用户问为什么Agent 却直接编辑了文件步骤 0问句类请求只交付发现和建议不改任何东西2做偏交付物Agent 做了 A 版用户其实要 B 版步骤 0模糊范围测试只问一个尖锐问题并附上推荐解读3翻旧账重新讨论用户早已拍板的决定步骤 0提取已做出的决定绝不重新推导4假完成没人包括 Agent 自己说得清结果是怎么检查的步骤 1开工前先定义完成并点名验证方式 第 2 步收集证据时失败模式 5–9#失败模式外部症状预防步骤Fable Method5编造 API代码调用了不存在的端点或函数签名步骤 2.1只信一手来源——去查文档或读包源码绝不靠记忆6串行爬行一次只查一个东西长任务永远跑不完步骤 2.2独立的查询合并成一批并行执行7上下文淹没整个文件、整段日志被倒进对话步骤 2.3只读需要的窄区间不重复读只引用关键行8分析瘫痪研究早就改变不了计划了却还在继续查步骤 2.4最多两轮查找第三轮必须给出理由否则停9硬冲意外证据已经和计划矛盾Agent 却强行按原计划执行步骤 2.5意外必须明说并让它重新导向循环⚖️ 第 3 步做决策时失败模式 10#失败模式外部症状预防步骤Fable Method10选项倾倒式汇报你可以选 A、B 或 C但没有任何推荐步骤 3只给一个推荐备选方案各占一行并说明落选原因 第 4–5 步执行与验证失败模式 11–14#失败模式外部症状预防步骤Fable Method11范围蔓延没人要求的顺手重构、风格重写、优化步骤 4.1最小正确修改匹配现有风格12静默丢步9 项任务里的第 7 项悄悄消失了步骤 4.3多步任务先写清单汇报前对照原始请求逐项核对13重试打转同一个失败的修法换个姿势反复试永远没有出口步骤 5重试要分路同一问题硬上限 3 轮然后带着输出和假设交还用户14验证剧场现在应该能用了但什么都没跑或目标检查过了、构建却坏了步骤 5验证必须被观察到且查目标周边系统两头三个代价最高的失败一眼识别法如果审计时只能查三件事Fable Method 明确给出答案查 1、13、14出自 failure-modes.md 的实战总结。擅自开修#1—— 它摧毁的是用户信任。你只是问了一句为什么它却动了你的代码这是所有失败里最伤感情的一种。重试打转#13—— 它烧掉的是时间和 token而且没有出口同样的小修小补反复 20 次本质是 3 次。验证剧场#14—— 它让坏工作被贴上完成的标签发货危害半径最大也是 AI 编码 Agent 被吐槽最多的声称一切测试通过现象。 顺带一提对照表还区分了跳步和假步——跳步是步骤被跳过假步更糟转录里声称步骤发生了却找不到任何观察记录。这就是验证剧场穿上循环的外衣审计要抓的就是它。怎么用这张表给 Agent 工作做体检这张表不需要你背下来它有两个现成的用法自动审计装好 Fable Method 后在任何一次 Agent 会话中运行/fable-method audit它会对照七步循环给刚完成的工作打分——每步标遵循 / 跳过 / 伪造并点名每个跳步制造的具体风险。人工复盘把它当作任意 Agent 转录记录的审查清单症状对号入座即可。想看看真实案例仓库内置了 8 个陷阱场景和完整案例研究例如 s2 惊喜陷阱Agent 面对一个本身写错的失败测试正确的做法是修测试而 159 次评测运行里只有遵循方法的中档模型 4/4 做对了结果日志见 eval/RESULTS.md。三步装好 Fable Method 开始防翻车克隆仓库git clone https://gitcode.com/gh_mirrors/fa/fable-method bash fable-method/install.shWindows 用 install.ps1。在 Claude Code 会话中用/fable-method 任务跑完整循环用/fable-method audit给已完成的工作打分。其他 Agent 框架Codex、Cursor、aider 等直接读 AGENTS.md这是去掉 Claude 专属格式后的同一套方法。延伸资料方法主体SKILL.md —— 约 110 行每句都有用失败模式对照表failure-modes.md每种请求形态的完整 worked exampleexamples.md八轮评测的方法与复现指南eval/README.md【免费下载链接】fable-methodThe Fable Workflow: how Claude Fable 5 worked, distilled into skills any model can run, with the eval that keeps it honest. Think / act / prove.项目地址: https://gitcode.com/gh_mirrors/fa/fable-method创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考