使用图片产生图片
Leonardo.Ai 除了文字提示产生图片,也提供 Image Guidance ( 运用图片产生图片 ) 的功能,只要上传范例图片,Leonardo.Ai 就会参考图片进而生成图片,这篇教学会介绍 Image Guidance 里强大的图片产生图片功能以及各种模式。
- 最新教学参考:2025 生成式 AI 工具推荐 ( 持续更新 )、AI 绘图的提示技巧
- 2024 年中 Leonardo.Ai 进行大幅度更新,虽然增加许多新功能,但许多好用的功能却消失了,如果要使用之前的版本,可点击 Image Generation 界面右上方“Legacy Mode”切换成传统模式。
- 因为 Leonardo.Ai 更新速度很快,有些画面可能会有些许差异,但操作用法仍然相同。
快速导览:
图片产生图片的功能
点击 Image Guidance 页签,就能打开图片产生图片的功能,如果启用了图片产生图片的功能,在 Image Guidance 的页签旁边会出现“ON”的提示。
Leonardo.Ai 提供许多种图片产生图片的功能,主要可以分成是“搭配 Prompt Magic”和“不搭配 Prompt Magic”两种,功能说明如下:
- 搭配 Prompt Magic:使用 Image Prompt 模式,将图片内容作为提示的一部分,类似 Midjourney 的 Blend 功能。
- 不搭配 Prompt Magic:使用十种图片产生图片模式,内建 ControlNet 控制网格功能。
例如下图的界面,如果启用了 Prompt Magic,产生图片的模式就只能使用 Image Prompt。
如果是付费的用户,可以同时使用四张图片作为图片产生图片的素材。
Image Prompt 图片提示
启用了 Prompt Magic 之后就能使用“Image Prompt”功能,Image Prompt 可以将图片作为提示使用,功能类似 Midjourney 的 Blend,设定参数 Strength 表示该张图片提示的强度,范围 0~1。
Image Prompt 不能和“PhotoReal”功能一起使用,付费的用户可以搭配 Alchemy 使用 ( Alchemy 须设定 Prompt Magic 为 V2 )。
举例来说,如果单纯输入“a cute dog”,会产生一只狗,但因为提示太少,所以产生的小狗不论是背景还是毛色都无法掌握。
如果上传一张石膏像的图片作为 image prompt。
产生的小狗就会是白色的毛,背景也会是白色的。
如果是付费的用户,可以上传其他的图片辅助,举例来说可以再上传一张花朵的图片,并调整图片提示的强度。
最后产生的图片就会变成白色的狗在绿色草地上。
Image to Image 图片产生图片
“Image to Image”功能可以提供“单张”图片,搭配提示词和设定产生相似的图片,功能类似 Midjourney 的 Remix,设定参数 Strength 表示该张图片提示的强度,范围 0~1。
使用 Image to Image 功能时,产生的图片与参考图片需要“长宽比例相同或接近”,如果两者差异太大,就可能产出无法控制的诡异的图片,且无法使用两张图片进行 Image to Image。
下方的范例上传了一张正在瑜珈运动的女生,Strength 设定 0.3,点击图片左下方的长宽比按钮,可以设定产生图片比例跟原始图片相同。
输入文字提示“a woman is doing yoga”,Leonardo.Ai 就会在原本的图片中进行加工,由于图片权重 Strength 只设定 0.3,所以除了姿势以外,不论穿着和长相都有些变化。
同理如果改成“a man is doing yoga”,参考图片就会更换成一个正在做瑜珈的男性。
Pose to image 姿势
“Pose to image 姿势”是 ControlNet 的其中一种模型,会截取参考图片中主体的“姿势”,再将文字提示词套用这个姿势,截取的姿势类似下图,Strength 表示提示的强度,范围 0~2。
使用 Pose to image 需要注意,Leonardo.Ai 判读姿势以“真人”为主,如果是插图、动物...等非人的姿势,在判读上就会有差异,举例来说,如果使用了插图的瑜珈女生,产生的图像就会很诡异。
举例来说,参考图使用正在瑜珈的女性,,Strength 设定 0.3,根据提示“a man is doing yoga at school”产生图。
最后结果就会变成男生在学校里面做瑜珈。
Edge to image 边缘
“Edge to image 边缘”是 ControlNet 的其中一种模型,会截取参考图中主体的“边缘”,再将文字提示套用这个边缘,截取的边缘类似下图,Strength 表示提示的强度,范围 0~2。
下面的范例上传了一张用小画家随意画出的图,套用文字提示“a cute monster”后,就会使用怪兽的造型与颜色,填满边缘。
如果使用插图的瑜珈女性作为参考图片,根据提示“a woman is doing yoga, realistic, photography”,就变成在做瑜珈的真人女生。
Depth to image 深度
“Depth to image 深度”是 ControlNet 的其中一种模型,属于大面积色块的模型,会截取参考图片中的“景深”,将文字提示套用在“清楚的景深”里,截取出来的景深类似下图,会先产生黑白的图像,然后将文字提示套用在白色的部分,颜色越白套用越多,Strength 表示提示的强度,范围 0~2。
下面的范例上传了一张用小画家随意画出的图,套用文字提示后,就会发现怪兽主要都产生在白色的区域。
Pattern to image 图案
“Pattern to image 图案”是 ControlNet 的其中一种模型,会截取参考图片中的“图案与花纹”,将文字提示套用在“图案与花纹”里,换句话说会使用文字提示中的内容,产生出来类似图案和花色的东西,举例来说如果提供苹果的图片,但是提示为山脉,则产生的山脉会按照苹果的图案进行排列,变成由山脉组成的苹果,Strength 表示提示的强度,范围 0~2。
这个做法的原理其实会先将图片进行“二值化”为黑白图像,再根据黑白图像绘制对应的内容,如果图片的颜色对比不够明显,产生的黑白图像就会不够清楚,得到的结果也就不尽理想,所以要使用 Pattern to Image,尽可能要让“主体与背景的颜色对比明显”,甚至可以直接使用其他绘图软件产生黑白图像,效果就会更好,举例来说,下图黄色香蕉白色背景,因为黄色白色太接近,二值化的效果不好,产生的香蕉图案就不明显。
为了让 Pattern to image 的效果更好,可以使用一些绘图软件增加图片对比度,举例来说可以使用 Google 云端硬盘内建的“Google 绘图”工具。
使用 Google 绘图工具打开香蕉图片,调整香蕉的亮度和对比度,使其主体和背景的差异较为明显 ( 也可调整颜色为灰阶,效果更好 )。
完成后下载为 jpg 文件。
回到 Leonardo.Ai,使用调整后的香蕉产生图像,就能得到更为漂亮的隐藏香蕉图像了。
Line Art
“Line Art”是 ControlNet 的其中一种模型,会提取图片中的线稿,让图片更加精细和丰富,Strength 表示提示的强度,范围 0~2,因为使用 Line Art 线稿会非常强调原本图片的线条,因此如果强度设定比较高,提示词反而会趋向增加图片的“材质”。
举例来说,使用一张苹果的图片,使用 Line Art 之后会完全保留苹果的线条细节,搭配提示词“beautiful clear crystal”就会产生透明水晶的苹果。
另外一个例子,如果使用的是人像图片,也可以使用 Line Art 保留图片的边缘线条,搭配提示词“sketch, pencil art”就能做到手绘效果。
Normal Map
“Normal Map”是 ControlNet 的其中一种模型,会计算图片中物体的表面法向量,进而计算物体表面的方向,透过表面的方向和光影还原原始图片的立体感,Strength 表示提示的强度,范围 0~2。
下图使用一个女生的人像摄影素材照片,搭配提示词“a cute girl at school , 2d cartoon”,完成后就会按照光影片话,产生同样光影位置的卡通角色。
QR Code to Image
“QR Code to Imagep”是 ControlNet 的其中一种模型,会根据提示词,填满或修饰 QRCode 原本的形状,Strength 表示提示的强度,范围 0~2,建议数值使用 1.5 以上,产生的 QRCode 才比较容易识别。
下图使用一张 QRCode 图片,搭配提示词“some fruits”,完成后就使用水果去组合成 QRCode。
使用同样的方式,提示词改成“brick maze, bird view, in the jungle”,就会出现像是砖头迷宫的 QRCode。
Sketch to Image
“Sketch to Image”是 ControlNet 的其中一种模型,会会将素描或手绘的图像,转换成上色的图像,Strength 表示提示的强度,范围 0~2。下图使用一张简单的速写图片,搭配提示词“a hand holds a pen”,完成后就会将速写转换成上色的图片。
运用这种方法,也可以将小朋友的手绘图,转换成上色版本的图像。
Text Image Input
“Text Image Input”是 ControlNet 的其中一种模型,会会将“文字图片”作为基底,运用提示去组合成文字图片的样子,Strength 表示提示的强度,范围 0~2。下图使用一张“赞”的黑白文字图片,搭配提示词“many fruits”,完成后就会用水果去组合成文字。
小结
图片产生图片 ( Image to Image ) 是非常强大好用的功能,特别在于如果有看到喜欢的图,但不知道文字提示该如何使用时,就能透过图片来产生图片,借由图片产生更多的创意。
微信扫码关注
抖音扫码关注