← 返回目录
h5.1概念⏱ 约 9 分钟

AI 标识:显式与隐式,不是一回事

学完你能说清两类标识各是什么、谁负责加,并知道法规从什么时候起施行

🔎 最后验证 2026-08📚 来源:《人工智能生成合成内容标识办法》原文;Gemini 图像生成官方文档;通义万相官方 API 文档;公开报道
为什么学这个

前面四章讲的全是"怎么把图做好"。这一章讲的是图做好之后,发出去之前,你还欠什么

第一件就是标识。这不是建议,是有明确施行日期的规定。

而这件事上最常见的误解是:很多人以为"我在文案里写一句'图片由 AI 生成'就算标了"。那只完成了一半——而另一半你可能根本没意识到它存在。

💡 打个比方

你寄一个包裹,上面要贴两样东西。

一样是面单:收件人、电话、地址,写在外面,谁都看得见。 另一样是条码:机器扫的,人眼看不出内容,但快递系统全程靠它识别。

你只贴面单不贴条码,包裹在分拣线上就是"不明物体";只贴条码不贴面单,收件人不知道该不该签收。

两样都得有,而且它们各干各的活。

规定说了什么

人工智能生成合成内容标识办法》由国家网信办、工信部、公安部、广电总局联合发布,2025 年 9 月 1 日起施行

适用范围明确包括:AI 生成合成的文本、图片、音频、视频、虚拟场景。——图片在里面。

它要求两类标识:

显式标识隐式标识
原文定义文字、声音或图形呈现,用户可明显感知文件数据中以技术手段添加,不易被用户感知
长什么样画面角落的"AI 生成"字样、播放前的提示语、发布时的声明元数据、数字水印
谁看得见机器(平台、检测工具)
谁来加通常要你自己确认通常由工具在生成时写入

"不是一回事"这句话的具体含义是:两者不能互相替代。 你在配文里写了"AI 生成",不代表文件里有隐式标识;文件里有隐式标识,也不代表读者能看见。

🔴 还有一层:隐式标识本身也不是"一种东西"

本课实测过三家工具(留档见 course-sources/ai-art/experiments/),结果是至少两套互不相认的体系:

TC260C2PA / Content Credentials
谁在用通义万相等国内工具OpenAI 等国际工具
什么标准中国国标(全国网安标委)国际标准(内容来源与真实性联盟)
长什么样一段 XMP 文本一个 二进制盒子,里面有证书链

🔴 关键在最后一行:查一套的检测器,看不见另一套。 本课实测:三张 OpenAI 出的图,TC260 一个都没有;第一批那 12 张万相图,C2PA 一个都没有

这对你的实际含义:

"我的工具带了标识"和"我要发的那个地方认这个标识",是两件事。 用国际工具出图发到国内平台,平台若按国标检测元数据,很可能检不到 —— 于是它转过来问你,而这时候如实声明的责任就落回你身上了

平台那一侧在做什么

据公开报道,抖音等平台在用户上传时会检测文件元数据里有没有隐式标识;检测不到的,会提示用户自己声明内容性质。

这条对你的实际含义有两层:

  1. 有隐式标识 → 平台可能自动识别并自动标注,你什么都不用做。
  2. 没有隐式标识 → 平台会问你,而这时候你必须如实声明。不声明,风险在你这边。

⚠️ 各平台的具体规则、检测方式与提示流程各家不同,而且会变。本课没有逐一核实各平台的当前规则,你要发布的那个平台,该去它的规则页看当天的说明。

隐式标识会不会在处理中丢掉

这是最实际、也最少被讲清楚的一个问题。

你出图之后通常还要做几件事:裁剪、压缩、加文字、导出、上传。这些步骤会不会把文件里的隐式标识洗掉?

2026-08-20,本课做了一次对照实验来回答它。 拿上一批实验里那 12 张带 TC260 国标标识的图 (见 h5.2),对它们做了 21 种加工,再逐一检测标识还在不在。

结果和直觉相反,一句话概括:

决定标识还在不在的,不是你对画面做了什么, 而是最后一次保存这个文件的那个程序,愿不愿意把元数据一起带上。

最能说明问题的是这一对:

你做的事画面变化标识
截图(或复制粘贴)一个像素都没变(解码后逐位相同)没了
做成 256×256 的头像边长缩到四分之一,体积只剩 1.45%还在

破坏画面最狠的那一格活下来了,一个像素没动的那一格反而没了。 裁掉两成画面、转成 JPEG、压到十分之一体积——只要用的是会带元数据的程序,标识全程都在。

同一件事,换五个工具做

下面五行做的是完全同一件事:把这张图转成 JPEG。

工具标识
ImageMagick(命令行)✅ 还在
sharp(网站后端常用的库,默认写法)❌ 没了
sharp + 显式要求保留元数据✅ 还在
macOS 自带的"导出为"(sips)❌ 没了
ffmpeg❌ 没了

五个工具做同一件事,三个把标识丢了。 而中间那两行是同一个库、同一个格式、同一个质量,只差一个"保留元数据"的参数——一个参数决定生死。

还有一格值得单独记:那个"导出为"保留了 Exif 和 Photoshop 的元数据块,唯独把标识所在的那块丢了"这个工具会保留元数据"不等于"它会保留标识"。

🔴 传播链是"与",不是"或"

实验里最该记住的一格是这个:先用会保留的工具导出一次(标识在),再让另一个工具存一次,标识就没了

翻译成现实:

你用了个规矩的工具导出,标识好好的。图发给同事,他随手用系统自带的"导出为"存了一遍—— 标识没了。而你们两个人,谁都不会收到任何提示。

链条上任何一环不带元数据,后面就全都没有。 这不需要任何人有恶意,只需要一次"另存为"。

🔴 而且两套体系的"抗造程度"差得很远

一模一样的 21 项加工分别对两种图跑一遍:

先说口径:那 21 项里有两项不是真实加工 —— 一项是"原图一个字节没动"(阳性对照), 另一项是"手工把标识块搬回去"(那不是活下来,是我搬过去的)。两项都剔掉,真实加工是 19 项。

源图标识体系19 项真实加工里活下来几项
通义万相出的图TC260(XMP 文本)12 / 19
OpenAI 出的图C2PA(二进制盒)🔴 0 / 19 —— 一项都没活下来

连上面那两个会保留 TC260 的工具(ImageMagick、sharp 加保留参数),也一样把 C2PA 丢掉。

原因不难理解:XMP 是通用的元数据容器,很多工具顺手就带上了; 而 C2PA 那个盒子需要工具专门支持,通用图片工具没有这个支持。

⚠️ 别把这条读成"C2PA 不如 TC260"。它装的信息多得多(软件、版本、时间、 做过哪些动作、内容哈希、证书链),而且它是签过名的。 代价是:它更挑工具。本课没有能力验签,只能看到清单里写了什么, 不能判断这份清单是真是假、有没有被改过

⚠️ 这次实测的边界(这一段比结论更重要)

  • 只测了两家工具:通义万相(TC260)与 OpenAI(C2PA),都只测元数据这一层没验签 —— 本课看得到清单内容,判断不了它是真是假
  • Gemini 的 SynthID 又是第三种东西(像素域技术,不在元数据里), Google 称它设计为可在截图、裁剪与格式转换后存活。 本课的检测器根本看不了它,不做评价 —— 上面的结论不能套到它身上
  • 只测了元数据这一层。 像素里有没有另嵌水印,需要厂商的检测工具,本课没有,不做结论。
  • 没测真实平台。 微信、微博、抖音、小红书上传之后还在不在,要用真账号实测才算数, 本轮没做——这一格仍然开放。实验里那格"社交平台式压缩"是本地模拟常见的压缩参数, 不是平台的真实行为,别当成平台实测来读。

📁 完整的 21 项加工产物、每一项的检测结果、以及 12 张原图的全量复核, 都留在 course-sources/ai-art/experiments/2026-08-20-b/,同目录有实操日志。 检测脚本自带阴阳自检,任何人都能原样复跑

所以实操上的正确态度是——这一版有证据了:

不要把合规寄托在"文件里应该还有隐式标识"这个假设上。 你甚至不需要做错什么,一次"导出为"就够了,而且全程没有任何提示。 显式标识由你自己加,这一步你完全可控。

你现在就能做的两件事

一、发布时主动声明。 在配文、图注或者发布页的选项里注明这是 AI 生成的内容。很多平台已经有专门的"AI 生成"标签开关,勾上它。

二、需要的话,在画面上留标识。 尤其是这几类:

  • 人像(容易被误认为真实拍摄,见 h3.5)
  • 看起来像新闻、纪实、证据的画面
  • 涉及产品宣传的图
⚠️ 避坑以为“我又不是商用,不用管”

《标识办法》的适用范围是按内容类型划的(文本、图片、音频、视频、虚拟场景),不是按你有没有赚钱划的

而且从实际风险看,顺序可能和你想的相反:

  • 商用内容通常有人把关,反而不容易漏;
  • 随手发的内容没人把关,而它一旦被误认为真实照片、被转发出去,后果不由你控制

一个具体的场景:你用 AI 做了一张很逼真的人像发在社交平台,没标。别人保存下来用在别处,或者当成真实照片转发——这时候即使你本意无害,事情也已经不在你手里了。

标识这件事的成本极低(勾一个选项、写一行字),而它防的是你完全无法控制的下游后果。这是这门课里性价比最高的一个动作,没有之一。

🔧 动手做:走一遍你的发布流程(4 分钟)

  1. 打开你最常发图的那个平台,找到发布页上有没有"AI 生成内容"之类的开关或标签
    • 找到了 → 记下它在哪。以后每次发 AI 图都勾。
    • 没找到 → 记一行"该平台未见 AI 标签,发布时在配文里自行声明"。
  2. 打开你最常用的出图工具,找找有没有水印设置(可能叫"水印""标识""watermark")。看它默认是开还是关。
  3. 把这两条补进你在 h0.4 建的那张工具卡里:

    "平台 AI 标签:〔在哪 / 没有〕。工具水印:〔默认开 / 默认关 / 未找到设置〕。"

  4. 给自己定一句话规矩,写下来:

    "凡是发出去的 AI 图,配文里必须有一句说明。"

你会看到:第 2 步经常查不到,或者查到之后发现默认是关的。这正是下一节要讲的事——两条技术路线在"标识"这件事上的态度,恰好相反。

为什么:这一步只花你几秒钟,但它是这一章里唯一完全由你掌控的动作。协议怎么写、判例怎么判,你都影响不了;发出去的时候标不标,你说了算。

❓ 测验
《人工智能生成合成内容标识办法》要求的两类标识,区别是什么?
❓ 测验
关于“隐式标识会不会在裁剪、压缩、导出过程中丢失”,本课 2026-08-20 的对照实验测出了什么?
✅ 小结

三句话收束这一节:

  1. 《人工智能生成合成内容标识办法》2025-09-01 施行,适用范围包括图片;要求显式(人可感知)与隐式(写在文件数据里)两类标识,两者不能互相替代
  2. 平台侧会检测元数据里有没有隐式标识,检测不到就会要求你自行声明——不声明,风险在你这边
  3. 隐式标识会不会在处理中丢失,本课这次实测了:决定它存亡的是最后保存文件的那个程序, 不是你对画面做了什么——截图会丢,压成 11KB 的头像反而不丢;传播链上任何一环不带,后面全没,且无提示。 所以结论没变,反而更硬:别把合规寄托在假设上,显式标识自己加

下一节把两条技术路线在这件事上的态度摆在一起看——一个默认强制加,一个默认根本不加,而你在语料的图上就能亲眼看到证据。

下一节 → 一个强制开,一个默认关
🔎 来源与核验· 9 条,点开核对
本节每个关键论断都对应一个可追溯的来源 —— 这是本课程"靠谱、不过时"的底线。
「《人工智能生成合成内容标识办法》由网信办、工信部、公安部、广电总局发布,2025-09-01 施行;适用范围包括文本、图片、音频、视频、虚拟场景」
📚 《人工智能生成合成内容标识办法》原文(cac.gov.cn)✓ 已核验 2026-08
「显式标识定义为以文字、声音或图形呈现、用户可明显感知;隐式标识定义为在文件数据中以技术手段添加、不易被用户感知」
📚 同上办法原文✓ 已核验 2026-08
「抖音等平台在上传时检测文件元数据是否含隐式标识,无则提示用户声明内容性质」
📚 公开报道(新华网)✓ 已核验 2026-08
「Google 称 SynthID 设计为可在截图、裁剪与格式转换后存活」
📚 多来源公开报道(转述 Google 说明;本课无能力验证该技术,不做评价)✓ 已核验 2026-08
「TC260 元数据标识的存亡取决于最后写文件的程序是否携带元数据,而非画面改动幅度:21 项加工中裁剪/缩放/转 JPEG/转 WebP/压至 11KB 头像均保留,截图(像素逐位未变)与部分工具的导出则丢失;同一库加与不加保留元数据参数结果相反;传播链任一环不带则后续全无」
📚 本课 2026-08-20 第二批对照实验(21 项加工 + 12 张全量复核;产物与检测结果见 course-sources/ai-art/experiments/2026-08-20-b/,观察记录见同目录实操日志)✓ 已核验 2026-08
「OpenAI gpt-image-1/gpt-image-2 输出的图片带 C2PA(Content Credentials)清单而不含 TC260;清单含动作 c2pa.created、软件与版本、IPTC 来源类型 trainedAlgorithmicMedia、内容哈希与 X.509 证书链(SSL.com C2PA 根/中间证书签发给 OpenAI OpCo, LLC);claim id 逐张唯一。同一套加工下,剔除阳性对照与手工搬运两项后的 19 项真实加工:C2PA 存活 0 项,TC260 存活 12 项(21 项原始计数分别为 2 与 14)」
📚 本课 2026-08-20 第三批对照实验(3 张;留档与检测结果见 course-sources/ai-art/experiments/2026-08-20-c/,观察记录见同目录实操日志)
智图软件的赞赏码
都看到这了,打个赏呗!
接下来 · h5.2
一个强制开,一个默认关:两条路线对标识的态度
继续读下一节 →