ControlNet大更新!仅靠提示词就能精准P图,保持画风不变!

点击下方卡片,关注“CVer”公众号

AI/CV重磅干货,第一时间送达

点击进入—>【Transformer】微信技术交流群

丰色 发自 凹非寺
转载自:量子位(QbitAI)

Stable Diffusion插件、“AI绘画细节控制大师”ControlNet迎来重磅更新:

只需使用文本提示词,就能在保持图像主体特征的前提下,任意修改图像细节。

比如给美女从头发到衣服都换身造型,表情更亲和一点:

88fcbcf98b47c1891a01bfe347d08ffa.png

抑或是让模特从甜美邻家女孩切换到高冷御姐,身体和头部的朝向背景都换个花样儿:

486c7ad404a9a82e7783d9731609f78b.png

——不管细节怎么修改,原图的“灵魂”都还在。

除了这种风格,动漫类型的它也能驾驭得恰到好处:

扫描二维码关注公众号,回复: 15095477 查看本文章

c023f0c51d7f9fdba776fe77a594b278.png

来自推特的AI设计博主@sundyme就称:

效果比想象得要好!

只需要一张参考图就能完成以上转变,部分图片几乎可以达到定制大模型的效果了。

咳咳,各位AI绘画圈的朋友们,打起精神来,又有好玩的了。

(ps. 第一三张效果图来自油管博主@Olivio Sarikas,第二张来自推特博主@sundyme)

ControlNet上新:保留原图画风的修图功能

以上更新内容,其实指的是一个叫做“reference-only”的预处理器。

它不需要任何控制模型,直接使用参考图片就能引导扩散。

作者介绍,这个功能其实类似于“inpaint”功能,但不会让图像崩坏。

(Inpaint是Stable Diffusion web UI中的一个局部重绘功能,可以将不满意、也就是被手工遮罩的地方进行重新绘制。)

一些资深玩家可能都知道一个trick,就是用inpaint来进行图像扩散。

比如你有一张512x512的狗的图像,然后想用同一只狗生成另一张512x512的图像。

这时你就可以将512x512的狗图像和512x512的空白图像连接到一张1024x512的图像中,然后使用inpaint功能,mask掉空白的512x512部分,漫射出具有相似外观的狗的形象。

在这个过程中,由于图像只是简单粗暴的进行拼接,加上还会出现失真现象,所以效果一般都不尽如人意。

有了“reference-only”就不一样了:

它可以将SD(即“Stable Diffusion”)的注意力层直接链接到任何独立的图像,方便SD直接读取这些图像作为参考。

也就是说,现在你想要在保持原图风格的前提下进行修改,使用提示词直接在原图上就能操作。

如官方示例图将一只静立的小狗改成奔跑动作:

0402841e3b26a484deefd39512fc262a.png

你只需要将你的ControlNet升级到1.1.153版本以上,然后选择“reference-only”作为预处理器,上传狗的图片,输入提示词“a dog running on grassland, best quality……”,SD就只会用你的这张图作为参考进行修改了。

网友:ControlNet迄今最好的一个功能

“reference-only”功能一出,有不少网友就上手体验了。

有人称这是ControlNet迄今为止最棒的一个功能:

传一张带有人物姿势的动漫图片,再写一句看上去跟原图完全无关的提示。突然之间,你想要的效果就在原图的基础上跑出来了。真的很强,甚至说是达到了改变游戏规则的程度。

022a95623dda2a45500c7b06197d5eba.png

还有人称:

是时候把以前丢弃的废图都捡回来重新修复一下了。

8138a6b62f1403fd83c35373b608f69c.png

当然,认为它也不是那么完美也有(比如开头第一张效果图里美女的耳环不对,二张图里头发也都是残缺的),但网友还是表示“总归方向是对了”。

a9abf747826dbdd1efcc73cd2999ff7b.png

以下是三位推特博主尝试的效果,主要都是动漫风,一起欣赏一下:

75debfd558859ec5f33dcd34d9d045ab.png

△来自@新宮ラリのAIイラストニュ

9820d1a94d245295d09f9fc651e28f92.png

△来自@br_d,左一为原图

106362ce0c22046c01d6e4790c10cf8b.png

△来自@br_d,上一为原图


1ce15c0e2e840c5b4201e0b4df16412d.png

△来自@uoyuki667,左一为原图

有没有戳中你的心巴?db4d54ad3a1e24c57c75654a1c358294.png

参考链接:
[1]https://github.com/Mikubill/sd-webui-controlnet/discussions/1236
[2]https://twitter.com/sundyme/status/1657605321052012545
[3]https://twitter.com/uoyuki667/status/1657748719155167233
[4]https://twitter.com/br_d/status/1657926233068556289
[5]https://twitter.com/aiilustnews/status/1657941855773003776

点击进入—>【Transformer】微信技术交流群

最新CVPR 2023论文和代码下载

 
  

后台回复:CVPR2023,即可下载CVPR 2023论文和代码开源的论文合集

后台回复:Transformer综述,即可下载最新的3篇Transformer综述PDF

目标检测和Transformer交流群成立
扫描下方二维码,或者添加微信:CVer333,即可添加CVer小助手微信,便可申请加入CVer-目标检测或者Transformer 微信交流群。另外其他垂直方向已涵盖:目标检测、图像分割、目标跟踪、人脸检测&识别、OCR、姿态估计、超分辨率、SLAM、医疗影像、Re-ID、GAN、NAS、深度估计、自动驾驶、强化学习、车道线检测、模型剪枝&压缩、去噪、去雾、去雨、风格迁移、遥感图像、行为识别、视频理解、图像融合、图像检索、论文投稿&交流、PyTorch、TensorFlow和Transformer等。
一定要备注:研究方向+地点+学校/公司+昵称(如目标检测或者Transformer+上海+上交+卡卡),根据格式备注,可更快被通过且邀请进群

▲扫码或加微信号: CVer333,进交流群
CVer计算机视觉(知识星球)来了!想要了解最新最快最好的CV/DL/AI论文速递、优质实战项目、AI行业前沿、从入门到精通学习教程等资料,欢迎扫描下方二维码,加入CVer计算机视觉,已汇集数千人!

▲扫码进星球
▲点击上方卡片,关注CVer公众号

整理不易,请点赞和在看6a70e5c686db81cdbf328e7a12973daa.gif

猜你喜欢

转载自blog.csdn.net/amusi1994/article/details/130717000
今日推荐