审核的盲区:多类事故,零命中
看懂模型审核的量程边界,学会判断哪些问题它结构上就抓不到
上一节我们搭好了换角色审核——角色换了,立场也换了,看起来滴水不漏。
现在泼冷水。我们的留档里记着一个扎心事实:在深度专注课(48 节)的生产中,发生了多类事故,审核步一类都没抓到。零命中。
不是审核角色偷懒,也不是提示词写得不好。这一节要给你的,是一个能带走的判断力:看一眼问题,就知道它在不在模型审核的量程之内。这个判断力,决定了你会把质检资源投在哪里。
体检抽血查血常规,查不出骨折。不是化验师不认真,是这个检查的量程根本覆盖不到骨头。要查骨头,你需要的不是更认真的化验师,是一台 X 光机。
零命中:我们自己的事故账本
深度专注课生产期间的多类事故,审核步全部漏过——这是我们自己的留档,不是转述。顺带一个诚实条款:留档对事故的计数存在内部矛盾(正文写的数目和表格列出的条数对不上),所以本课统一说"多类",不写精确数字。连"这个数我们数不准"都要如实告诉你——这也是下一模块"数字必须跑命令核"的一个预告。
为什么零命中:信息不在场
留档给每类事故都附了机制解释,共同点只有一个:事故发生在审核步的可见范围之外。
逐类看:
- 进程级故障:任务中途断了,审核步根本没被调用——谈何抓到;
- 模块边界问题:审核一次只看一个模块,模块内自洽的编号错误、跨模块的引用错位,它看不见"隔壁";
- 跨工作流总数核对:大纲和成稿的总数账要跨两个工作流对,审核步手里只有当前这份稿。真实例子:另一门课的留档里记过"大纲 41 节、成稿 47 节"的账对不上(注意,这个例子出自另一门课的留档,不是深度专注课那份事故清单里的一条);
- 语法层问题:MDX 编译报错这种事,模型读文本时根本不"运行"它,读起来通顺不等于编译能过;
- "下一片"预告:分片生产时每片看不到相邻片,预告写错了自己也不知道。
这就是审核的系统性盲区:不是审核不认真,是这类问题结构上就不在它的视野里。输入里没有大纲总数、没有相邻分片、没有编译器——信息不在场,提示词写得再好也抓不到。
这个结论把我们推向哪里
看不见的东西,得靠另一种东西来看。凡是"数得清、判得死"的结构问题——总数、编号、编译——都该交给不依赖模型的检查。这就是下一节的主角:机械闸门。
🔧 动手做:给你的翻车清单标注量程(6 分钟)
- 拿出你在上一模块末尾整理的翻车检查清单。
- 逐条问两个问题,并标注:
- 一个只看当前这份稿子的审核角色,能抓到这条吗?→ 标"审核能抓";
- 还是它需要看到大纲、相邻分片、编译结果、进程日志才可能发现?→ 标"审核抓不到"。
- 数一数两栏各有几条,把标注结果存进留档。
你会看到:上一模块的三类事故——结构擅改(需对照大纲)、非法编号(需下游解析才炸)、假完整(需数数核对)——大概率全部落在"审核抓不到"一栏。
为什么:这份标注就是本模块阶梯产出的一半:一张按"量程"分好类的问题清单。下一节你会给"审核抓不到"那一栏逐条配上机械闸门,清单才算闭环。
"再优化优化审核提示词就行"——这是把可见范围问题误当成认真程度问题。审核步的输入里没有大纲总数、没有相邻分片、没有编译器,信息不在场,提示词写成什么样都抓不到。正确的响应不是优化审核,而是给这些问题另配检查手段——下一节的机械闸门。
审核的系统性盲区是本节唯一的新概念:模型审核有量程,凡是需要大纲、相邻分片、编译器、进程日志才能发现的问题,结构上就不在它视野里——深度专注课多类事故零命中就是我们自己的账本。你已经把翻车清单按量程分好了类。下一节,给"审核抓不到"那一栏配上永不给面子的检查员。
🔎 来源与核验· 3 条,点开核对
