AI 配的图为什么总像在「应付」:我翻了一个白板的插画方法论,一图只许讲一个判断
这两天 AI 配图、AI 做 PPT 又火了一把:一段话丢进去,排版配图全自动。但你仔细看那些 AI 配的图——构图挺满,元素挺多,可你就是记不住它想说什么。像极了开会时 PPT 做得最漂亮但什么都没讲的那个人:图在应付,人在走神。
我没跟着调 prompt,也没去找笔刷包。我干了另一件事——去翻了一个开源手绘白板项目(boundless,「无界白板」)的内置技能:文章插画。它治"配图应付"的方法跟 prompt 半毛钱关系没有:给 AI 立规矩,一图只许讲一个判断。
看完我可以负责任地告诉你三件事。
第一,它的哲学只有五个字——“一图一判断”:每张图只回答"这一段最想让人记住的一个判断"。产出的是手绘解释图,不是装饰画,不是流程图。
第二,它有一套"隐喻发明法":三步把抽象概念变成画面,还规定"换一篇内容还成立的图,就是模版"——专治 AI 配图的"万能灯泡综合征"。
第三,最狠的是一张"失败信号速查表":左上角有图题、小人只是站着、满页直线箭头——任一命中,图作废重画。
1. 先看病:AI 配图为什么总像在「应付」
先给大家科普一个概念「装饰画 vs 解释图」:装饰画的任务是填满空白,解释图的任务是让人记住一个判断。AI 配图总像在应付,因为它默认画的是装饰画——prompt 说"给这段配个图",它就理解成"找个好看的填充物"。于是灯泡、齿轮、握手、火箭齐上阵,图和文字各说各话,你把图遮住,文章一点不受影响。
翻译成人话:一张配图如果删掉不影响理解,那它从一开始就不该存在。
boundless 的文章插画技能(article-illustration,v1.0.0)开宗明义划了这条线:产出是"白底黑线、怪诞但成立、一眼能读懂的手绘解释图"。画面可以荒诞(小人卡在机器里、扛着漏斗分拣),但逻辑必须成立。这四个字"怪诞但成立",就是整个技能的审美宪法。
2. 第一步:动笔前先选题——一图一判断
技能规定,落笔之前先在思考里完成"选锚点":通读全文,只挑认知锚点配图——核心判断、断点、输入输出闭环、分流、前后对比、常见坑、状态变化。
翻译成人话:只给"读者最容易卡住、也最值得记住"的地方配图。通篇正确的废话不配图,配了也是装饰。
配套三条铁律。不平均配图:短文 1~2 张,长文不超过 4 张——“每段来一张"的结果就是没有一张让人记住,数量上限逼着你做选择。没有锚点的段落,宁可不画:把"不画"也变成合法选项,很多配图系统的失败恰恰在于不允许"不配图"这个答案。先出清单不落笔:用户只要配图建议,先出文字清单——放哪段、核心意思、用什么结构、小人做什么、2~5 个标注词,先把"讲什么"想清楚再谈"怎么画”,顺序不能反。
学完这一步你能带走的第一个方法:配图前先写"一图一判断"清单,每张图一句话写出要让读者记住的判断,写不出来就删掉这张。不管用什么生图工具,这条都成立。
3. 第二步:演员必须干活——小人模板
默认主角是个"小黑式小人":黑色实心圆头 + 实心胶囊身体、两粒白点眼、细线四肢、空表情(不画嘴)——“认真做一件荒诞但成立的事”。
三条演员纪律,条条见血。小人必须承担核心动作,禁止站旁边当装饰:卡在机器里、拉杆、搬运、守门、称重、接东西——小人要在画面里"做事",一个站旁边微笑的小人和装饰画没有区别。尺度夸张:小人高度不超过主体物件的 1/3、不超过版面高度的 1/10——戏剧感来自落差,AI 配图透着"平",病根就是所有元素差不多大。故事类内容讲解员退位:画寓言案例时用故事角色演(小马过河就画马、牛、松鼠),“辨识三件套”(轮廓剪影、主色、标志特征)至少两维拉开,否则小马老马同框分不清谁是谁。
还有条细节:说话者必须在场——气泡尾巴必须指向说话者,且说话者必须画在图里,“台词悬空等于没有出处”。AI 生图里悬空的文字、没主人的对话框,根子就是缺这条纪律。
学完这一步你能带走的第二个方法:检查你的 AI 配图,问三个问题——有人/角色在"做事"还是摆拍?最大物件和最小角色落差够大吗?每句台词找得到主人吗?一个"否",就是装饰画。
4. 第三步:隐喻发明法——三步把抽象变成画面
最难的是"把抽象概念画出来"。技能的"隐喻发明法"分三步:抽象概念 → 物理动作(卡住、漏掉、变重、分拣、沉淀、发酵、折叠、回流——先翻译成身体能做的动作);系统结构 → 低科技物件(纸箱、漏斗、水管、邮筒、抽屉、井、梯子、秤,一次只用 1~2 个——越日常的物件,读者理解成本越低);小人承担动作(拉、扛、塞、捞、压、称、守、推、接、拆、标记——用小人的身体把动作和物件连起来)。
配套两条"防油腻"纪律。域物件优先:专业内容画领域内的物件,讲数据库画叠层圆柱、讲实验画烧瓶——读者是内行,就别拿外行比喻糊弄他。慎用万能象征:放大镜(查找)、灯泡(灵感)、齿轮(机制)、时钟(效率)、钥匙(方案),只有原文"确有该语义"时才许用。以及全篇最狠的一句:“换一篇内容还成立的图,就是模版”——这次用"漏斗分拣"讲筛选,下次讲筛选必须换物件换动作。能复用的不是画面,是发明画面的方法。
学完这一步你能带走的第三个方法:让 AI 配图时,别只给主题,给"动作+物件"——不说"画一张讲技术债的图",说"画一个小人背着越来越重的包袱爬楼梯"。你替 AI 做掉"发明隐喻"这一步,它就不会去请灯泡和齿轮救场。
5. 第四步:七种结构,对号入座
“讲什么、谁讲、怎么讲"都有了,还差"摆成什么样”。技能给了七种结构类型,每张图选一种:流程闭环(左输入→中处理→右输出)、前后对比(左混乱右稳定,不对半切)、角色状态(2~4 个小状态)、概念隐喻(一个大怪物件,要有记忆点)、方法分层(一层层盒子往上摞)、路线地图(弯曲路径+小人走)、小分镜(2~3 格一格一动作)。
翻译成人话:这是"作文模板"不是"美术模板"——约束的是信息组织方式。你的判断是"前后对比"就用第 2 种,是"难懂的概念"就用第 4 种。对号入座,AI 就不会把"对比"画成"流程"。
6. 第五步:画面铁律与失败信号——终检清单
画完终检,先看"画面铁律"。平衡优先于序列:围绕一个视觉重心组织,“禁止全部排在一条水平线上”——“一字排开"是 AI 配图最常见的死法,一眼 PPT SmartArt 味。流线纪律:箭头用主色、比物件轮廓更细,“一条弯曲线优于多条直箭头”,只给主路径画箭头——箭头是血管不是电线,弯曲、细、有主次。语义色:橙(0xE8590C)=主路径,红(0xC92A2A)=问题,蓝(0x1A5FD7)=补充,每张彩色不超过 3 处——颜色是语义不是装饰。标注纪律:每张 2~5 个短标注挂在动线节点上,想写段落回文章里写去。签名位:左下角一条橙色短横线配一行小字——这张图的"判断句”,一句话可复述。
再看"失败信号速查",任一命中即修:左上角有图题;小人只是站着;满页直线箭头;元素排成一条水平直线;画面像正式流程图/PPT;节点太多文字变段落。
翻译成人话:清单里的每一项都是 AI 配图最爱犯的病。它不是"画好"的标准,是"不及格"的红线——先保证不犯病,再谈画得好。这个思路值得所有做 AI 内容工具的人抄:与其教 AI 什么是好,不如先教会它什么是烂,烂的直接打回。
7. 为什么这样设计:插画是解释,不是装饰
回头看——一图一判断、演员干活、隐喻发明、七种结构、画面铁律——背后是同一句话:插画是解释,不是装饰。
有意思的是,这套方法论不是从零发明的。commit 里写着:它"吸收了九个外部插画技能(xiaohei/gimi/littlebox/orange-line 等)的方法论,矢量化落地为白板构图规范"。翻译成人话:先把别人验证过的吃透,再按自己的画布重写一遍——学思想,不抄皮囊。正因为方法是载体无关的,它后来才能被"跨载"到 slides 和黑板报技能里:PPT 用宿主主色、黑板报用粉笔色,变的是版式,不变的是"一图一判断"和画面铁律。连黑板报的装饰规则都被反向改造:“插图主题优先,通用装饰降为兜底”——太阳花朵云朵这类通用装饰,从默认选项降级成"实在没招才用"。一套方法论能反向改造兄弟技能,说明它长成了"纪律",而不只是"建议"。
给开发者的建议
- 先写"一图一判断"清单再让 AI 动笔。每张图一句话写出要让读者记住的判断,写不出来就删掉——对任何生图工具都成立。
- 给"不画"留合法席位。短文 1~2 张、长文 ≤ 4 张;没有认知锚点的段落宁可不画。数量上限是最便宜的质量过滤器。
- 画面里必须有角色在"做事"。禁止吉祥物式站位;检查落差、检查台词有没有主人。
- 抽象概念先翻译成"物理动作+低科技物件"。你替 AI 做掉"发明隐喻"这一步,它就不会请灯泡和齿轮救场。
- 慎用万能象征,标准是"换篇内容还成立的就是模版"。用之前先问:原文真的有这个语义吗?
- 先定义"烂",再定义"好"。列一张失败信号速查表,任一命中即打回——拦住烂,比教会好更立竿见影。
说到底,这套插画方法论回答了一个所有做 AI 内容的人都要回答的问题:当 AI 什么都能画时,什么不值得画?它的答案是:只画"能让读者记住一个判断"的图,其余的宁可留白。克制不是画得少,是每一笔都知道自己在为什么服务。一张好配图的标准从来不是"好看",而是"删掉它,文章会损失点什么"。