Skip to content

你的 AGENTS.md 多久没体检了?

柏林ACS · 2026-08-02 · 读完约需 5 分钟

一个项目的 AGENTS.md 写了八个月,从最初的半屏长到三屏。最近 AI 的表现越来越怪:回答有时详尽有时极简,新功能里冒出旧技术栈的写法,还有些规则,你盯着看,想不起来它为什么存在。

模型没有退化,是配置老化了。配置从写完那天开始老化,老化的方式主要有四种。

病灶一:过期条目。 文件里还躺着旧技术栈的约束、已下线功能的注意事项、换掉的品牌名。AI 在新旧两套指令之间摇摆,行为变得不可预测。

病灶二:相互矛盾。 "回答要详尽"和"回答要简洁"同时躺在文件里,各自都有道理,谁也没被删掉。结果是 AI 每次随机满足其中一条——你看到的是"它怎么又不听话了"。修法通常不是删除其一,而是补边界:"列表场景从简,解释场景从详"。

病灶三:随口偏好混入。 第 09 篇聊过的那类:你都想不起来什么时候写的条目,语气像聊天记录("尽量别搞太复杂哈")。它们照样在生效,出了问题无从排查。

病灶四:覆盖偏科。 几十条产出规范——别写注释、别用某库、别超过多少行——而定位、受众、取舍标准一片空白。结果每条规范都被遵守了,做出来的东西却不符合需要:规范管的是"怎么写",没有人告诉它"什么算好"。

四种病灶对应一次体检的动作。逐条问三个问题:今天还成立吗?和别的条目矛盾吗?当时是经过决定写进来的吗?然后退一步看分布:约束是全部堆在规范上,还是定位、原则、协作各有着落?

体检结束时,每条配置落进三栏之一:保留(今天仍成立)、修订(方向对,但过期或有歧义,补边界)、下线(不再成立,或本就不该入库)。

两个细节值得说清楚。一是频率:项目里程碑、AI 表现明显漂移、或者每季度一次,哪个先到按哪个。二是修订与下线要单独提交、写清原因——这份文件的提交历史,就是项目搜索演化的历史:什么时候学会了什么,什么时候放弃了什么。下线是流程的正常出口,没有出口的配置库只会越长越臃肿。

体检清单放在公开仓库 acs-templates 的"场景清单"目录里,照着查一遍大概二十分钟。如果你用 Claude Code,acs-skills 里的 acs-config-review 是它的自动执行版。理论出处是《AI认知搜索理论》第九章与第十三章。

体检不用隆重,下一个里程碑就是现成的时机。之后我们换个话题——现在很多 AI 产品都有"记忆"功能,它到底记住了什么,又漏掉了什么?

最近更新: