← 返回目录
h3.5动手⏱ 约 11 分钟

人像与头像:样本最多、最费字、也最敏感的一类

学完你会按人像四层下笔,并知道"用谁的脸"这条线不能越

🔎 最后验证 2026-08📚 来源:本课对 229 条配对语料的结构化统计;《人工智能生成合成内容标识办法》;本课语料中的配对样本
为什么学这个

人像是语料里样本最多的一类:51 条,占 22%。也是最费字的一类:中位数 425 字,是 3D 手办的三倍。

它的需求最普遍——换个头像、做套形象照、给文章配个人物图。它的技术难度也最集中,因为人脸是所有人最挑剔的东西:差一点点,就"怪"。

但这一节要先讲的不是技术,是一条线:你打算用谁的脸? 这个问题的答案,决定了后面所有事情能不能做。

💡 打个比方

你请画师画一幅肖像。

画一个虚构的人——没问题。 画你自己——把照片给他,没问题。 画你朋友——你得先问过他。 画一个明星——画来自己看没问题,印在商品上卖就是另一回事了。

画笔换成 AI,这四种情况的区别一点没变。 变的只是第四种的成本从"要有画功"降到了"打一行字"。

先划那条线:用谁的脸

情况能不能做
完全虚构的人可以
你自己可以
他人(朋友、同事、模特)需要本人同意;商用要书面授权
公众人物 / 明星🔴 本课的立场:不做。 未经授权使用他人肖像是明确的红线,而 AI 让它变得极其容易

🔴 关于最后一行,本课把话说死:

这门课自己的案例库里,凡是涉及可辨认真人肖像的语料,一张都没有展示。 那批语料里确实有——一位真人演员的杂志风肖像、一位喜剧演员与他的车、一位职业球员的正面特写——它们技术上都很好,但一张都不会出现在这门课里。

为什么专门说这件事?因为做给你看,比说给你听有用。一门讲 AI 绘画的课,自己在案例选择上守住了这条线,这比一句"请注意合规"有说服力得多。这条选择标准和它的完整清单,h5.5 会讲。

人像四层

定完"用谁的脸",技术部分按四层写。语料里这一类各项出现率都是全场最高,说明专业做人像的人四层都会写:

第一层:人是谁(主体)。 这一层没有出现率可言——不写就没有内容。 年龄段、性别、大致长相、发型发色、穿什么。如果有参考图,这一层可以极大压缩(h2.3)。

第二层:光线(该类出现率 82%,全场最高)。 人像的气质几乎全在光上。三个决定:

  • 顺光:干净、平、显年轻 → 证件照、职业照
  • 侧光:立体、有情绪 → 文艺、有故事感
  • 逆光/轮廓光:边缘发亮、氛围强 → 时尚、电影感

第三层:镜头与机位(该类 75%,全场最高)。

  • 景别:头像用近景或特写;形象照用中景;环境人像用全景。
  • 机位:平视最中性;略微俯拍显脸小、显亲和;仰拍显气场但容易显凶。
  • 虚实:背景虚化是"专业感"最省事的来源之一。

第四层:材质与细节(该类 84%,全场最高)。 这一层在人像里主要指皮肤。写"自然的皮肤纹理""可见的毛孔",比写"高清"有用得多——过度光滑的皮肤是"AI 味"最大的来源

两个方向的案例

方向一:环境人像——人在一个具体的地方。

个人资料 / 头像 - 极简街头风咖啡馆人像
人像 / 写真个人资料 / 头像 - 极简街头风咖啡馆人像
271 字。人物、店面、桌椅、地面的碎石、店招——每一样都具体,所以整张图有“这是一个真实存在的地方”的感觉。
🎨 生成这张图的提示词
超写实柔和美学时尚人像,一位 {argument name="age" default="21 岁"} 的 {argument name="gender" default="男士"} 随意地坐在户外极简咖啡馆的黑色矮椅上,身穿 {argument name="clothing" default="米色超大款半解扣衬衫,袖口卷起,搭配黑色修身长裤、白色厚底运动鞋和米色棒球帽"},坐在椅子上,姿态放松且富有情绪感,一只手靠近脸部,印度街头风 …
它写了四件事:**主体**(21 岁男士、米色超大款半解扣衬衫、卷袖、黑长裤、白厚底鞋、米色棒球帽、一只手靠近脸部);**光线**(自然光);**材质与环境**(碎石地面、植物与木质元素);**色彩**(柔和的米色与灰色调),外加一个比例。\n\n🔎 **但它恰恰没写镜头与机位**——中远景、平视、背景轻微虚化这些是模型自己定的。这说明 h1.1 那句话:**十二格是检查表,不是填空题**,不写的格子由模型接管,而这一次它接管得不错。\n\n⚠️ 两个附带观察:店招上的“terra COFFEE ROASTERS”是**虚构品牌且文字写对了**(落在 h1.9 的可写对区间);提示词结尾的 `--ar 4:5` 是**另一家工具的参数写法**,和 h1.10 那条 `::` 权重记法一样——它在这个模型上有没有生效,本课无法判断。
出图模型:Nano Banana / Gemini 图像生成作者:Zar⭕on来源:YouMind许可:CC BY 4.0

方向二:影棚人像——把环境全部去掉,只剩人和光。

电商主图 - 鼠尾草绿单色时尚图册
电商 / 产品电商主图 - 鼠尾草绿单色时尚图册
351 字。背景是纯色,没有任何环境信息,所有信息量都压在服装、姿态和光上。
🎨 生成这张图的提示词
一场专业的时尚摄影棚拍摄,主角为一位 {argument name="subject" default="年轻东亚女性"},留着利落的下巴长度波波头,展示现代 {argument name="style" default="鼠尾草绿单色穿搭"}。她身穿剪裁合身的鼠尾草绿衬衫式马甲,搭配同色系高腰阔腿裤,肩上优雅地披着一件质感十足的鼠尾草绿超大款羊毛风衣。配饰包括叠戴的金色链条项链(带钥匙吊坠)、精致的金手镯,以及米色厚底绑带渔夫凉鞋。场 …
这一张展示了 h1.8 讲的**单色限制**在人像上的用法:背景、风衣、马甲、阔腿裤全部是同一个色相,只有木箱、鞋和金饰是中性色。**限制越硬,画面越有设计感**——观众的注意力被压到造型和姿态上,没有别的地方可去。\n\n🔎 **但这张图也暴露了一个限制。** 提示词原文要求的是“生成**一系列**全身和四分之三身的**多角度镜头**:自信站立单手插兜、坐在木箱上、以及调整翻领时微笑的动态半身照”——**实际交付的是一张,一个姿势**。这正是 h2.6 讲的那件事:**跨镜头的成套需求,不是一条提示词能一次交付的**;真要三个姿势,要么让它同框出多格,要么分三次做并靠骨架保持统一。
出图模型:Nano Banana / Gemini 图像生成作者:Minahil来源:YouMind许可:CC BY 4.0

一条不能忘的:人像图要标 AI

《人工智能生成合成内容标识办法》2025 年 9 月 1 日起施行,适用范围明确包括图片。它要求两类标识:显式标识(用户能明显感知的文字、声音或图形)和隐式标识(在文件数据里以技术手段添加、不易被用户感知)。

人像这一类尤其要注意,原因很实际:一张 AI 生成的人像,比一张 AI 生成的风景更容易被误认为真实拍摄。 而平台侧(如抖音)在上传时会检测文件元数据里有没有隐式标识,没有的话会提示用户自己声明。

具体怎么标、显式和隐式各是什么、各家工具的默认行为差多少——H5 整章讲这件事,这里只需要你记住:人像图发出去之前,标识这一步不能省。

⚠️ 避坑皮肤磨得太光,和五官的“平均脸”

AI 人像有两个最典型的破绽,而且都不是"画错了",是"画得太完美了"。

一、皮肤过于光滑。 没有毛孔、没有细纹、没有色斑、没有一点点油光——真人不长这样。观众说不出哪里怪,但会觉得假。 解法:在材质那一层写具体的皮肤描述——"自然的皮肤纹理,可见的毛孔,轻微的不均匀肤色"。

二、五官过于对称、过于"标准"。 模型倾向于生成一张各方面都居中的脸,结果是好看但没有辨识度,一批图看下来觉得都是同一个人。 解法:给一两个不对称的具体特征——"左眉略高""笑起来只有一边有酒窝""鼻梁略微偏"。这也是 h2.5 讲的"记忆点",一举两得。

共同的道理是:h1.7 讲过,现实里的东西很少是完美的,一个"崭新到没有任何痕迹"的物体反而显得假。人脸上这条规律更强烈。

🔧 动手做:做一张属于你自己的头像(6 分钟)

  1. 先答那条线:这张图用谁的脸?
    • 你自己 → 找一张正脸清晰、光线均匀的照片当参考图,走 h2.3 的路子。
    • 虚构的人 → 继续第 2 步。
    • 别人 → 先去问对方
  2. 四层按顺序写:
    • 主体:年龄段、发型、穿什么、表情。
    • 光线:顺光/侧光/逆光,选一个,写明想要的效果。
    • 镜头:近景还是特写?平视还是略俯?背景虚不虚?
    • 材质:写一句具体的皮肤描述,别写"高清"。
  3. 加一个不对称的记忆点。(这一步很多人会跳过,别跳)
  4. 加比例:头像用 1:1。
  5. 出图后检查三样:手(如果入镜)、眼神方向是否一致、皮肤是不是太光滑。
  6. 发布前:确认标识这一步(见 H5)。

你会看到:第 3 步的记忆点会让图立刻"像个人"而不是"像张脸"。这是投入产出比最高的一句话。

为什么:人像是需求最大的一类,也是最容易停在"好看但没有辨识度"的一类。四层是骨架,记忆点是灵魂,而那条"用谁的脸"的线是前提——前提不成立,后面做得再好也不能用。

❓ 测验
语料统计显示,人像/写真类中写材质的 84%、光线 82%、镜头 75%,均为各分类最高。这三个数字共同说明?
❓ 测验
关于“用谁的脸”,本课对公众人物/明星肖像的立场是?
✅ 小结

三句话收束这一节:

  1. 先划线:用谁的脸。虚构和自己可以;他人需同意、商用需书面授权;公众人物本课不做,并且在案例选择上执行了这条。
  2. 人像四层:主体 → 光线(该类 82%)→ 镜头(75%)→ 材质(84%,主要指皮肤)。三项都是各分类最高。
  3. 两个破绽都来自"太完美":皮肤过光(写具体的皮肤纹理)、五官过于标准(给一个不对称的记忆点)。发布前别忘 AI 标识(H5)。

下一节讲一类字少、图形简单、反而最适合 AI 的活儿:Logo、图标与品牌物料。

下一节 → Logo、图标与品牌物料
🔎 来源与核验· 5 条,点开核对
本节每个关键论断都对应一个可追溯的来源 —— 这是本课程"靠谱、不过时"的底线。
「人像/写真类 51 条(占 22%),中位 425 字;该类写材质 84%、光线 82%、镜头 75%,均为各分类最高」
📚 本课对语料的结构化统计(脚本 analyze-corpus.mjs,含阳性/阴性自检)✓ 已核验 2026-08
「《人工智能生成合成内容标识办法》2025-09-01 施行,适用范围包括图片,要求显式标识与隐式标识两类」
📚 国家网信办等四部门《人工智能生成合成内容标识办法》原文✓ 已核验 2026-08
「平台侧在上传时检测文件元数据是否含隐式标识,无则提示用户声明」
📚 公开报道(新华网)✓ 已核验 2026-08
「环境人像案例中虚构店招文字渲染正确;单色系影棚人像案例中背景与服装统一为同一色相」
📚 本课语料中的配对样本(成品图可核)✓ 已核验 2026-08
「本课案例库不展示任何可辨认真人肖像的语料」
📚 本课的案例选择标准(完整清单见 h5.5)✓ 已核验 2026-08
智图软件的赞赏码
都看到这了,打个赏呗!
接下来 · h3.6
Logo 与图标:AI 做得最好的一类,但它做的不是 Logo
继续读下一节 →