← 返回目录
h1.9概念⏱ 约 10 分钟

画面内的文字:能写对了,但有一条很清楚的边界

学完你会知道 AI 什么时候能把字写对、什么时候一定写错,并据此决定文字交给谁做

🔎 最后验证 2026-08📚 来源:Gemini 图像生成官方提示词模板;本课语料中的配对样本
为什么学这个

"AI 画不对字"曾经是句常识。歪扭的字母、拼错的单词、根本不存在的汉字——这是早期 AI 出图最好认的特征。

这件事变了。官方文档现在把准确渲染文字单列成一类提示词模板,而语料里也确实有大量文字完全正确的成品。

但它没有变成"想写什么都能写对"。这一节要给你的,是那条边界具体在哪——而讲清这条边界最好的办法,是先给你看一张失败的图。

💡 打个比方

让一个从没学过中文的人照着描几个汉字。

描"福"字?没问题,笔画不多,他盯着描,能描得挺像。 描一整页小楷?到第三行他就开始糊弄了——因为他描的不是字,是形状,而形状一多,他就只能保证"看起来像一页字"。

AI 写字就是这个状态。 它复现的是字形,不是文字。字少、位置明确、字号大——它能盯住;字多、密集、小——它只能保证"看起来像有字"。

先看成功的:中文标题,一个字都没错

小红书封面
海报 / 广告小红书封面
一张小红书封面。标题和四行正文全是中文,包括标点和 emoji,一个字都没错。
🎨 生成这张图的提示词
画图:画一个小红书封面。
要求:
有足够的吸引力吸引用户点击;
字体醒目,选择有个性的字体;
文字大小按重要度分级,体现文案的逻辑结构;
标题是普通文字的至少2倍;
文字段落之间留白。
只对要强调的文字用醒目色吸引用户注意;
背景使用吸引眼球的图案(包括不限于纸张,记事本,微信聊天窗口,选择一种)
使用合适的图标或图片增加视觉层次,但要减少干扰。

文案:重磅!ChatGPT又变强了!
多任务处理更牛✨
编程能力更强💪
创造力爆表🎨 …
它成功的原因写在提示词里:**文案被单独列出来,原样给出**(“重磅!ChatGPT 又变强了!”那几行是直接抄进提示词的);**字号有明确的层级要求**(“标题是普通文字的至少 2 倍”);**明确要求段落之间留白**;**要求只对要强调的文字用醒目色**。也就是说,这条提示词把文字当成一个**排版任务**来交代,而不是随口说“上面写点字”。
出图模型:Nano Banana / Gemini 图像生成作者:@balconychy来源:awesome-nano-banana许可:CC BY 4.0

再看失败的:同一个模型,密集标注全线崩溃

信息图 / 教育视觉图 - 工程产品信息图设计
电商 / 产品信息图 / 教育视觉图 - 工程产品信息图设计
844 字的工程拆解信息图。构图、透视、爆炸视图的引线全都到位——但把任何一处标注放大看,文字几乎全是乱码。
🎨 生成这张图的提示词
超精细技术工程信息图,简洁的 {argument name="background color" default="白色"} 背景,由清晰的黑色分隔线划分为精确的 {argument name="grid layout" default="2×2 网格"}。蓝图风格的工业设计可视化,包含逼真的 3D 渲染、透明剖面图、爆炸视图、尺寸标注、技术说明框、测量指南以及颜色编码的工程箭头(红色、蓝色、绿色、橙色)。专业产品设计演示,Apple  …
随便挑几处:“Battery Ecolosure”“Anodiseed Mesisaer”“A15 Blanic 6-core CPU, 5nm ansames”“Face ID- Super Ratina XOR OLEO”“LENE ASSENSY”“CENTRRL PCB”“MEMORY CARD SLGT”——**没有一个是真正的英文单词**,但每一个都“看起来像”那个词。这不是模型偷懒,是它在用同一套“像不像”的逻辑处理文字(见 h0.2 那块乱码站牌)。注意这张图的提示词长达 844 字、结构相当讲究,**失败的不是提示词水平,是任务本身超出了边界**。
出图模型:Nano Banana / Gemini 图像生成作者:⁠ luciaAI来源:YouMind许可:CC BY 4.0
智图软件的赞赏码
都看到这了,打个赏呗!
接下来 · h1.10
版式与留白:给后期留位置
继续读下一节 →