Skip to content

为什么你收藏的提示词技巧,时灵时不灵?

柏林 · 2026-08-01 · 读完约需 5 分钟

一家公司的 AI 应用小组,做过一件看起来很正确的事。

他们把半年里所有被验证有效的提问方式整理成一份《Prompt 手册》:怎么让 AI 扮演角色,怎么分步推理,怎么列失败模式……一共八十多条,全公司推广。

一个月后,反馈两极分化。最有意思的是同一条技巧,两个团队的评价截然相反:一个团队说"列失败模式"是用过的最好的技巧,另一个团队说它纯粹浪费时间——两边都是认真执行了的。

技巧是验证过的,执行也到位,为什么效果像掷骰子?

这个场景你多半不陌生。你收藏过的那些"十个必学提示词",用起来大概也是这种感觉:这条灵,那条不灵;这个项目灵,换个项目就不灵。

问题不在技巧,在于技巧是碎片。每一条技巧作用的,其实只是整个交互的某一个部分——瓶颈恰好在这个部分时,立竿见影;瓶颈在别处时,自然无效。那个团队的方案方向从没被怀疑过,所以"列失败模式"一用就灵;另一个团队的瓶颈根本不在方向,而在没人说清过"什么样的结果算好"——方向上的技巧再犀利,也够不着。

所以真正的问题是:一次 AI 回答的背后,到底有哪几个部分?

这就是今天这篇的正题。前面两篇我们聊过:你的提问在 AI 开口前就划定了搜索的起点和方向;每一次回答都是一条搜索轨迹。把这些线索收拢起来,一次回答其实是四层结构的一次完整搜索:

第一层,搜索初始化:AI 从什么状态开始。 开口之前它知道什么、不知道什么。同一份报错信息,直接丢过去,和先喂一页项目背景再丢过去,出来的答案质量差很多。

第二层,搜索目标:为什么搜,什么算好。 你没说清评价标准,它就按自己的默认标准来——而它的默认标准,往往只是"看起来像个好答案"。

第三层,搜索空间:能去哪些地方。 方向够不够宽,有没有被逼着走出最顺的那条路。第一篇聊的"找三个失败原因",动作就发生在这一层。

第四层,搜索运行:具体怎么走。 一步一步来还是一步到位,走错了有没有人喊停。"请分步分析""检查一下你的推理",都是这一层的操作。

四层合起来,就是一次回答的完整构造。这个构造最大的用处是诊断:一次失败的回答,病灶必然落在某一层里。

下次 AI 给出让你失望的回答,别急着换说法重试,按顺序问四个问题:

  1. 初始化:它知道做这件事必需的背景吗?还是对这个项目一无所知?
  2. 目标:我说清楚"什么结果算好"了吗?还是只说了要做什么?
  3. 空间:它是不是只走了最容易的那条路?要不要换个入口、多开几条路?
  4. 运行:过程有没有人检查?要不要它分步来、自己核对一遍?

四问下来,你大概率能定位到具体卡在哪一层——然后只修那一层。这就是"结构"和"技巧清单"的区别:清单让你碰运气,结构让你做排查。

这四个问题我们做成了一张在线诊断清单,回答出问题的时候打开照着查就行。公众号读者回复"诊断"两个字,会直接收到链接。

回头看那份手册,结局也有了。小组后来没有补充任何新技巧,只是用四层给八十多条技巧做了一次盘点,结果发现六十多条挤在"空间"这一层,目标和初始化几乎是空白——而失效反馈恰恰集中在那两层。补上"成功标准模板"和"项目背景卡"之后,手册还是那本手册,但从碰运气的技巧汇编,变成了按层归位的工具箱。

这张四层结构图出自一本免费在线的书《AI认知搜索理论》,今天聊的内容在第三章里有完整展开——包括每层各自的失效方式,以及长期项目里那层更重要的东西:搜索配置。

这本书正在连载。下一篇,我们从第一层开始逐层拆开:AI 开口之前,它已经拥有了什么?

最近更新: