把提示词写成表格后,AI出图终于不再千篇一律了
作为一个过来人,我在这事儿上踩的坑真不少。
去年十一月初在杭州出差,晚上回酒店闲着没事,想用AI画几张图发朋友圈,结果连着生成了七八张,清一色都是那种“标准网红脸”风格——背景虚化、光线完美、构图工整到像从同一家影楼出来的哈。
我换了好几种描述词,什么“黄昏下的老街”“雨后的咖啡馆”,出来的东西还是那个味儿。
当时我就觉得,这玩意儿是不是就这水平了?
后来我邻居老周,一个在广告公司做视觉的,他跟我说你光写一段话扔进去不行,得把提示词拆成表格来写。
我一开始没当回事,觉得不就是换个格式嘛,能有多大区别。
结果他给我看了他做的对比:左边是纯文字提示词出的图,右边是表格化提示词出的图,差别真挺明显。
右边那张街景里,路灯的色温偏暖,地面积水反射着招牌的霓虹,远处有个模糊的行人轮廓——细节丰富太多了。
我这才服气,回来就开始试。
核心结论
把提示词写成表格之后,AI出图的差异化程度大概能提升三四倍。
这个数字我是自己对比出来的,同一组主题,文字提示词连续生成十张,构图重复率差不多有七成;换成表格之后,十张里能挑出六七张各有特色的。
为啥呢?
因为表格逼着你把“主体、环境、光线、镜头、风格、情绪”这些维度分开写,AI模型在处理结构化信息的时候,权重分配会更清晰。
你一股脑写一段话,AI很容易抓住最显眼的那个词使劲发挥,剩下的全给你糊弄过去。
我之前用某款国产AI绘画工具,想画一个“老式理发店里的猫”。
文字提示词写的是“一只橘猫坐在老式理发店的椅子上,复古风格,暖光”。
出来的图倒是不难看,但那个理发店跟现代美发沙龙没啥区别,就加了点棕色滤镜。
后来我把提示词改成表格:主体写“橘猫,趴姿,尾巴垂在椅面边缘”,环境写“八十年代理发店,白瓷砖墙,铁质理发椅,墙上挂着手写价目表”,光线写“下午四点侧窗自然光,色温3200K左右”,镜头写“35mm定焦,f/2出头,略微俯拍”,风格写“柯达胶片质感,轻微颗粒”。
你猜怎么着?
出来的图连价目表上模糊的“剪发两块五”都能隐约看出来(这个我真没想到)。
具体方法
我现在固定用四五个维度来做表格。
第一个是主体描述,别只写“一只猫”,要写清楚姿态、位置、和周围物体的关系。
比如“猫的左前爪搭在椅面边缘,头朝画面左侧偏转约三十度”。
这种细节写进去,AI就不太容易给你生成那种千篇一律的正面大脸照了。
第二个是环境层。
这里有个小窍门,写上具体年代和地域特征。
我试过写“九十年代成都街边茶馆”,出来的竹椅和盖碗茶就比写“中式茶馆”要地道得多。
第三个是光线,这个最容易被忽略。
你写“自然光”和写“阴天下午三点漫射光,光源在画面右后方”,出来的阴影方向和质感完全两码事。
第四个是镜头参数。
别怕写专业术语,AI吃得进去。
我经常写“50mm焦段,f/1.8,焦点在猫的眼睛上,背景有轻微虚化”。
第五个是风格和情绪,这个可以写得感性一点,比如“安静的午后,有点怀旧,像小时候外婆家的感觉”。
但要注意,情绪词别写太多,一两个就够了,写多了AI会给你加一堆莫名其妙的元素。
- 主体描述要带位置和姿态,别只写名词
- 环境写清楚年代和地域,越具体越好
- 光线写方向、色温、时间点
- 镜头参数写焦段和光圈,控制景深
- 风格情绪最多写两个词,贪多会乱
我上个月用这个方法帮一个做电商的朋友生成产品图。
他要拍一款复古台灯,之前找人拍一套要花差不多两千块。
我用表格写了提示词,生成二十多张,挑出五张能用的,后期稍微调了下色就上架了。
他跟我说省下来的钱够请我吃三顿火锅(这个我真没跟他客气)。
不过也有翻车的时候。
有次我表格里光线写的“烛光”,环境写的“中世纪城堡”,结果AI给我生成了整个大厅都是蜡烛的图,密密麻麻跟着火似的。
后来我才明白,光线维度里的词不能和环境维度里的词重复,重复了AI会加倍渲染那个元素。
所以现在我做表格,每个维度的关键词都会检查一遍,避免语义重叠。
还有一点,表格不是让你填得越满越好。我刚开始每个格子都塞五六个词,出来的图反而很乱。后来控制在每个维度两到三个核心词,效果最稳。比如主体就写“猫、趴着、尾巴垂下”,环境就写“旧书店、木地板、下午”,干净利落。