AI 绘图的提示技巧
虽然 AI 绘图已经发展了快两年,但随着 AI 绘图工具不断更迭,大家使用的工具也不断变化,因此 AI 绘图的“提示技巧”也就格外重要,这篇教学会介绍如何“思考和建构”一幅作品的画面,只要妥善运用这些技巧,不论使用哪套 AI 绘图工具,都能得心应手的快速画出好图。
快速导览:
通用提示技巧
虽然 AI 绘图工具对于文字的“理解能力”越来越好,但仍然会遵照一些“通用”的提示原则绘图,大多数的 AI 绘图工具,会按照“顺序”决定图片里对象的权重,就好比要委请一个真人画图,通常都会先把要画的主题讲出来,而不是讲了许多辅主的话才说重点。
怎么跟人沟通,就怎么跟 AI 沟通
输入提示词时,按照文字从左到右书写的习惯,衍生出下列通用原则:
- 文字越往左权重越大,越往右权重越小。
- “比较重要的内容”放在左侧 ( 例如主题、主角、构图...等 )。
- “辅助型的内容”放在右侧 ( 例如风格、配色、材质...等 )。
- 使用“逗号”分隔每一段提示词。
- 使用“英文”提示词 ( 除非是搭配 ChatGPT 的 Image Creator 对中文理解力较好 )。
- 使用“正向提示词”,避免“不要什么”之类的语句 ( 如果要避免出现特定内容,可使用 AI 工具“负向提示词”功能 )。
- 提供“参考图”。
- 避免“矛盾”( 例如提示词要“半身照”,却又出现“穿着红鞋”之类的提示 )。
如果图片的提示词“内容都相同,但排列顺序不同”,就会产生完全不同的结果,举例来说,下方两张图的第一张图,因为小狗的提示词放在最左侧,主角就会是小狗,但第二张图因为小狗放在最右侧,飞机放在最左侧,就会变成好像飞机是主角的构图。
曼陀罗九宫格思考法
大谷翔平是美国职棒大联盟最顶尖的球员之一,也是目前唯一最成功的二刀流选手,在他成功之后,不少人开始探讨大谷翔平的成长过程,也透过他的高中棒球教练和父母,了解大谷翔平建立自身计划的“曼陀罗九宫格计划表”,这份计划表会按照下列拟定计划:
| 曼陀罗九宫格位置 | 说明 | 范例 |
|---|---|---|
| 中心点 | 主要目标 | 八球团第一指名。 |
| 围绕中心点的 8 个方格 | 实现主要目标要做的 8 件事。 | 体格、控球、球质...等。 |
| 8 个方格延伸出去的 64 个方格 | 完成这八件事要做的 64 件事 | 身体保养、喝营养品、柔软度...等。 |
了解曼陀罗九宫格计划表后,也可以按照下方步骤,将其应用于 AI 绘图的提示词,产生“AI 提示词之曼陀罗九宫格规划表”,运用这种方式,不仅能产生相当完整的提示词,更可以训练自己分析图片的能力,虽然这些提示词可能不能满足所有情境,不过一但有了完整提示词,后续要做修改或删减就十分容易,不论更换了哪套 AI 绘图工具,都能运用这种方式,轻松撰写提示词。
| 曼陀罗九宫格位置 | 说明 | 范例 |
|---|---|---|
| 中心点 | 主题 | 一男一女在咖啡店喝咖啡。 |
| 围绕中心点的 8 个方格 | 绘制主题需要的八种要素 | 主角、动作、背景、光线、角度、风格...等。 |
| 8 个方格延伸出去的 64 个方格 | 完成这八种要素要提供的 64 个元素 | 年轻男生、拿着咖啡杯、正面摄影...等。 |
举例来说,如果想要绘制“一男一女在咖啡店喝咖啡”的主题,可以先从心中想像出画面 ( 或找一张不错的图 ),这接着按照曼陀罗九宫格的规划,分析心中画面的长相 ( 或分析自己找到的图 ),写出下方的主题要素:
- 背景:年轻的一男一女在咖啡店里坐在桌前喝咖啡,桌上放着一本深蓝色书皮的书。
- 角色:男生戴着黄色毛线帽穿着灰色长袖连帽T-Shirt,女生长发戴着红色围巾穿着水蓝色长袖毛衣。
- 动作:两个人开心的拿着白色马克杯。
- 视角:一男一女都正面向镜头,半身照。
- 风格:3D 卡通黏土风格,迪士尼 3D 动画风格。
- 光线:明亮舒适的光线。
下图是预期要产生的图片,或自己搜索到的参考图。
将这些提示词组合后,就能得到完整的提示词“年輕的一男一女在咖啡店裡坐在桌前喝咖啡,桌上放著一本深藍色書皮的書,男生戴著黃色毛線帽穿著灰色長袖連帽T-Shirt,女生長髮戴著紅色圍巾穿著水藍色長袖毛衣,兩個人開心的拿著白色馬克杯,一男一女都正面向鏡頭,半身照,3D 卡通黏土風格,迪士尼 3D 動畫風格,明亮舒適的光線”,接着就能根据提示词画出相关画面。
- 如果撰写出“较长”的提示,使用文字理解力较好的 Image Creator 效果会更好。
- 自己练习时,能够产出“八成像”的图片就是成功了。
使用 AI 帮你写提示词
在“Poe 教学 - 建立自己的 AI 提示词机器人”教学里有介绍打造自己机器人的方法,运用这种方法,搭配上述的“曼陀罗九宫格提示法”,就能打造一个“专门产生绘图提示词”的机器人。
注册“Poe AI”并登录后,点击左上角“建立 Bot”按钮,选择“提示词 Bot”开始建立机器人。
输入机器人的名称以及选择机器人使用的语言模型,范例使用 Gemini-1.5-Flash ( Google 的大型语言模型,消耗点数最少,语言处理能力中上 )
将下面的指令复制贴到“提示词”字段中,替这个机器人增加“最高指导原则”,并取消启用优化预览提示词,这些指导原则可以随个人喜好自由调整,这篇教学提供的通用的版本。
你现在是一个擅长写“产生图片提示词”的 AI 绘图专家,我会传送给你要生成图像的提示词或参考图,你会按照下列规则进行回应:
1、我不会跟你聊天,传送给你的所有文字都是我要产生图片的提示词。 2、以我的提示词为主轴,扩展成更具有想像力、画面更好的的提示词。 3、修改的提示词请具备“主角、简单动作、背景、风格、视角、光线”。 4、提供我两种不同内容的繁体中文和英文提示词。 5、如果我提供你图片,请提供请根据“主角、简单动作、背景、风格、视角、光线”,提供我可以产生类似图像的繁体中文和英文提示词。 6、如果我传送“缩短提示词”,就将你美化的提示词缩短为 50 字左右的长度,再次提供给我。
参考下方范例: 提示词原文:“一男一女在咖啡店里喝咖啡” 美化后的提示词:“年轻的一男一女在咖啡店里坐在桌前喝咖啡,桌上放着一本深蓝色书皮的书,男生戴着黄色毛线帽穿着灰色长袖连帽T-Shirt,女生长发戴着红色围巾穿着水蓝色长袖毛衣,两个人开心的拿着白色马克杯,一男一女都正面向镜头,半身照,3D 卡通黏土风格,迪士尼 3D 动画风格,明亮舒适的光线”
取消启用 Bot 权限公开以及相关 Bot 推荐后,点击“建立 Bot”就能建立这个 Bot。
接着与这个 Bot 对话,输入简短的提示词“一男一女在咖啡店裡喝咖啡,迪士尼 3D 動畫風格”之后,Bot 就会将简短的提示词,扩展成更丰富的内容。
最后就能利用 AI 绘图工具,根据提示词画出相关的图片。
除了单纯扩展提示词,这个 Bot 也具备“分析图片”的能力,只要上传图片,就能分析图片内容并转写提示词,下方范例上传了刚刚一男一女在喝咖啡的图片,就可以得到相关提示词。
最后就能利用 AI 绘图工具,根据提示词画出相关的图片。
让 AI 在图片中加入文字
如果要在图片里加上文字,只要是“人类”,通常都会使用“文字工具”来添加文字,但对于 AI 而言就没有这么简单,原因在于 AI 在生成具有文字的图片的方式和人类完全不同,产生图片的同时文字也会一并生成,因此往往会发生拼写错误或乱写一通的情况,以下图展示 AI 产生图片的初期,会从许多种子噪声慢慢生长出图像,这种情况就类似要求一个人在不使用文字工具的情况,用一点一点的方式画出具有文字的图片,这时就算是人类,也无法顺利产生正确的内容。
此外,也由于中文的字元数量远大于英文和数字,若加上每个中文字的“笔画”,数量就更为可观,因此目前没有任何一套 AI 工具能够绘制中文字,如果要添加中文字,都必须使用其他绘图软件添加。
| AI 较容易生成 | 字数 | AI 完全无法生成 | 字数 |
|---|---|---|---|
| 英文字母大小写字数 | 52 | 基本中文 | 2500~2600 |
| 阿拉伯数字 | 10 | 标准中文 | 4500~5000 |
| 标点符号 | 10~20 | 日文汉字 | 2000~2500 |
下方范例的右图,只是要 AI 写一个“大”的中文,产生的结果却乱七八糟。
虽然 AI 不能加入中文,但对于英文和数字的理解能力还算不错,例如 Ideogram 和 Image Creator 就能产生较为正确的英文字和数字 ( 无法每张图片都产生正确的文字,只是准确率相对而言较高 ),如果要在图片中加入文字,可使用“双引号”或“单引号”包覆要加入的文字,参考下方的写法:
- word "文字"
- text "文字"
- name "文字"
- say "文字"
下方范例使用“A Gozilla in the city with large "GOZILLA" text behind it, poster”提示词,就能在画面中产生“GOZILLA”的文字。
有时也可以使用“对话泡泡”的方式,让画面具有类似漫画的风格,下方范例使用“Four cartoons in Japanese style. [1]a Pikachu uses a speech bubble to say "hi", [2]Pikachu sees Spongebob, [3]Pikachu uses a scream bubble to shout "PIKA!!!" ,[4]Spongebob was shocked by Pikachu's discharge., illustration”提示词,就能在画面中用“对话泡泡”包覆文字。
- speech bubble:对话泡泡
- thought bubble:思考泡泡
- scream bubble:尖叫泡泡
- whisper bubble:悄悄话泡泡
使用绘图和摄影术语
撰写提示词的过程中,有时遇到“词穷”或“不知道术语或风格名称”的状况,这时就可以参考下方的教学,替自己的提示词中,加入一些绘图的名词或术语,让自己的提示词更加完整和精准。
- 完整参考:AI 绘图风格大全
小结
透过以上的方法,基本上已经可以写出相当有架构且产出不错质量的图片,接下来需要做的事情就是“练习分析”,只要看到不错的图片,就尝试去分析这张图片,用自己的语言将图片描述得巨细弥遗,随着不断的练习,就会发现自己能写出更多更好的提示词了。
最新教学参考:2025 生成式 AI 工具推荐 ( 持续更新 )
微信扫码关注
抖音扫码关注