自查倾向:自己查自己,人和 AI 都不靠谱
认清“同一对话自查”为什么不算质检,为换角色审核铺路
你大概试过这样一幕:让 AI 写完一段东西,接着问它"检查一下,有没有问题?"它认认真真列了几条——"可以更生动""结构可以再紧凑"——然后你放心地用了。
但事后翻车的,往往不是"不够生动",而是事实写错了、数字对不上、整段跑题。这些实质性问题,它自查时一个都没提。
这不是你运气差。这一节要讲清一件事:审核者和被审核者是同一个立场时,审核会退化成盖章。理解了这一点,你才能理解后面整个"写/审/改 + 机械闸门"的架构为什么长那个样子。
让学生自己批自己的卷子,会发生什么?大概率是"怎么看都是满分"。不是他故意作弊,而是他做题时的思路和批卷时的思路是同一套——当初为什么这么写,现在就为什么觉得对。批卷的眼睛和答题的手,共用一个脑子。
自查为什么会退化成盖章
我们这条课程产线的设计文档里,写着一条设计理由:同一角色自查,倾向于确认自己的产出。要说明的是:这是我们在实际生产课程过程中形成的设计经验,不是做过对照实验的普适结论——它解释了我们为什么这样设计,但你不该把它当成一条已证明的定律。本课按诚实条款如实告诉你证据的射程。
机制上不难理解(这是本课的解读,日志里没有记录机制):让写作的那个对话去检查自己刚写的东西,它的上下文里装满了"我为什么这么写"的理由。你以为它在挑毛病,其实它在复述自己的立场。指令是"检查",执行出来的是"辩护"。
这就是自查倾向:审核的有效性,取决于审核者与被审核者之间有没有真实的立场差。立场差为零,审核输出趋近于确认。
这不是 AI 独有的毛病
人类内容行业早就撞过这堵墙,也早就给出了解法:作者不当自己书的书评人。出版社请外部评审,报社让编辑和记者分属两个岗位,软件团队让写代码的人不给自己的代码做最终审查——全都是同一个原理:把"挑毛病"交给一个上下文里没有辩护理由的人。
所以对 AI 的解法也不神秘:换一个立场相反的角色来审。下一节我们就在产线里做这件事。
换别的工具怎么做
这条原则和你用什么 AI 工具无关。无论是 ChatGPT、Claude 还是任何对话产品,"同一对话自查"和"新开对话换角色审"是两种完全不同的操作——前者不算质检,后者才有机会算。如果这门课用的产线明天停更,这条原则一个字都不用改。
🔧 动手做:亲手复现一次自查盖章(5 分钟)
- 打开你常用的 AI 对话工具,让它写一段 300 字左右的介绍文(题材随意,比如介绍你的产品或你的家乡)。
- 在同一个对话里接着问:"检查一下你刚才写的内容,有什么问题?"
- 数一数它给自己挑了几个毛病,并给每条分类:是实质性的(事实错、结构错、断言无依据),还是装饰性的("可以更生动“”语气可以调整")。
- 把这段介绍文和这份自查结果都存下来——下一节要拿它做对照实验。
你会看到:多数情况下,你会得到几条不痛不痒的装饰性建议,很少见到它推翻自己的事实断言。
为什么:亲眼看到"自查 = 盖章"一次,胜过读十遍原理。而且这份存档是下一节换角色审核的对照组——没有对照,你无法判断换角色到底带来了什么。
"我让 AI '严格检查',它就会严格"——这是最常见的误解。问题不在指令的措辞,在于审核者的上下文。同一对话里,"严格检查"只是在写作立场之上叠加了一层语气,立场本身没换。要换立场,得换角色、最好换对话——这正是下一节的内容。
检查一下你刚才写的这段【介绍文主题】,有什么问题?请逐条列出,并说明每条是事实性问题还是表达性问题。
自查倾向是本节唯一的新概念:审核者与被审核者立场相同时,审核会退化成盖章。这不是 AI 特有的毛病,人类编辑行业早用"作者不当自己的书评人"对付它了。你已经亲手存下了一份"同对话自查"的样本——下一节,我们换一个专门抬杠的角色,和它正面对比。
🔎 来源与核验· 2 条,点开核对
