证据分级:这条原则的证据其实不强
学会给每条断言标 A/B/C 等级,并对本课自己的核心原则做同样的审查
课程讲到压轴,按套路该总结升华了。我们偏要反着来:当众审查这门课最核心的设计原则,并告诉你——它的直接证据其实不强。
为什么要这么干?因为诚实条款不是只用在别人身上的。前几节我们审查了自己的数字、公开了自己的勘误;这一节把同一把尺子,量到本课的方法论根基上。
顺便,你会学到一个在任何输出结论的工作里都用得上的框架:证据等级标注。学完这节,你会亲手给全课五条核心原则各标一个等级——你会发现它们参差不齐。
天气预报说"降水概率 70%",而不是"肯定下雨"。这不是含糊,是精确——它把结论和结论有多可靠分开告诉你了。证据分级做的就是这件事:每条断言旁边挂一个可靠度标签,让读者自己决定信多少、哪里需要自己再验证。
分级标准:从来源硬度到断言射程
我们产线的创作宪法给出的原始定义是:A=官方文档/源码直接支持,B=多来源互证,C=单一来源,D=无法验证(不得写进正文)。为了便于你在自己的产线上套用,本课把它按“断言的射程”做了一次教学化重述——两套说法是同一个内核:来源越硬、互证越多,断言能覆盖的范围就越大。
| 等级 | 宪法定义 | 教学化重述(射程) | 例子 |
|---|---|---|---|
| A | 官方文档/源码/一手留档直接支持 | "我们这条产线发生了 X"——一手记录,附复现命令/日志路径 | "第一版写错两个数字,命令核出"(留档+命令俱在) |
| B | 多来源互证 | "X 在我们这里是反复出现的"——多个具体案例互证 | "分片接缝造成三类隐蔽错误"(三个具体案例互证) |
| C | 单一来源 | "所有 AI 产线都会 X",或只有单次观察支撑的设计判断 | 见下面的压轴案例 |
| D | 无法验证 | 不得写进正文 | (本课已剔除) |
记住一句话:射程越远,等级越低。 说自己产线的事,有留档,直说,标 A;外推到"所有人都会这样",就得降级,并明说"这是我们的经验,不能外推"。
压轴案例:机械闸门的证据是 C 级
回看全课,哪条原则最核心?大概是机械闸门——"模型自检不可靠,必须用不依赖模型的脚本检查"。整个产线的质检架构都建立在它上面。
它的证据是什么等级?C 级。 核心依据是一次单例观察:同一模块重跑两次,一次合规一次违规——就这一处记录。"模型自检不可靠"作为一条普适原则,在我们的留档里只有单例支撑。
我们本可以不说这个。课都讲到最后了,说"核心原则证据不强"图什么?图的正是这门课反复讲的东西:对自己的核心设计原则,做和对别人一样严的分级审查。结论是——这是一条我们采纳了、且实践中没有后悔的设计判断,但它的直接证据是单例,请你在自己的产线上自行验证。
这句话比"业界公认必须加机械闸门"诚实得多,也有用得多:它明确告诉你哪里该自己补实验,而不是让你把一条经验判断当成定律背下来。
换别的工具怎么做
证据分级是纯方法论,零工具依赖:
- 写行业报告,给每个结论标"一手调研 / 二手引用 / 个人推断"。
- 做竞品分析,标"实测 / 官网宣称 / 传闻"。
- 内部提案,标"数据支撑 / 案例支撑 / 直觉判断"。
标签的名字随场景换,内核不变:把"我说了什么"和"我有多少证据说它",分开交代。
🔧 动手做:给全课五条核心原则标等级(10 分钟)
- 列出全课至少这五条核心原则:唯一事实来源、换角色审核、机械闸门、断点续跑、DRY-RUN 默认预演。
- 根据你在本课各模块看到的证据(留档记录、案例数量、是否有复现路径),给每条标 A/B/C 级。
- 每条写一句理由:证据是什么形态?一手留档还是单例观察?有几个案例互证?
- 对照检查:标出来的等级里,哪条你打算在自己的场景里先补验证?
你会看到:一张五行的分级表——等级参差不齐,其中"机械闸门"的核心动机只有 C 级单例支撑。这张表就是你把本课方法带回自己产线时的"待验证清单"。
为什么:亲手给学过的原则分级,是对"射程越远,等级越低"最直接的操练;同时它逼你区分"我信这条"和"我有证据信这条"——这正是本节唯一要教的事。
C 级不等于"错",A 级也不等于"永远对"——等级只描述证据形态。两个常见的误用:一是拿低等级当借口拒绝一切经验判断("证据不强所以不做");二是给自己偏爱的结论悄悄升级("我觉得对所以是 A")。前者让你寸步难行,后者让整套分级作废。
本模块验收清单
走完 W6,对照自检——每一项都应该有一份你亲手做出的东西:
- 至少 1 条书面的 DRY-RUN 规则,且亲手走过一次"预演 → 确认 → 执行"流程(6.1)
- 自己产出里的 3 个数字,每个都有可重跑的复现方法,并实际核过一遍(6.2)
- 一条"错在哪 → 怎么发现的 → 改成了什么"三段式勘误记录,或一份"N 项全过"的审计留档(6.3)
- 一张全课五条核心原则的 A/B/C 分级表,每条附一句理由(6.4)
四样齐了,这个模块的产出才算落地:你带走的不是"知道了这些原则",而是一套已经在你自己的产出上跑过一遍的安全与诚实机制。
证据分级的内核只有一句:射程越远,等级越低——把结论和结论的可靠度分开交代。本课对自己的核心原则做了同样的审查:机械闸门的直接证据是 C 级单例,我们照常采纳,但明说它待你在自己的场景里验证。诚实条款,先用在自己身上——本课的讲授到这里为止。最后一节不再有新概念:把 W1-W6 的全部阶梯产出装订成《你的产线方案 v1.0》,一份能直接投产的东西。
🔎 来源与核验· 3 条,点开核对
