ControlNet大更新！仅靠提示词就能精准P图，保持画风不变！

点击下方卡片，关注“CVer”公众号

AI/CV重磅干货，第一时间送达

点击进入—>【Transformer】微信技术交流群

丰色发自凹非寺
转载自：量子位（QbitAI）

Stable Diffusion插件、“AI绘画细节控制大师”ControlNet迎来重磅更新：

只需使用文本提示词，就能在保持图像主体特征的前提下，任意修改图像细节。

比如给美女从头发到衣服都换身造型，表情更亲和一点：

抑或是让模特从甜美邻家女孩切换到高冷御姐，身体和头部的朝向、背景都换个花样儿：

——不管细节怎么修改，原图的“灵魂”都还在。

除了这种风格，动漫类型的它也能驾驭得恰到好处：

扫描二维码关注公众号，回复： 15095477 查看本文章

来自推特的AI设计博主@sundyme就称：

效果比想象得要好！

只需要一张参考图就能完成以上转变，部分图片几乎可以达到定制大模型的效果了。

咳咳，各位AI绘画圈的朋友们，打起精神来，又有好玩的了。

（ps. 第一三张效果图来自油管博主@Olivio Sarikas，第二张来自推特博主@sundyme）

ControlNet上新：保留原图画风的修图功能

以上更新内容，其实指的是一个叫做“reference-only”的预处理器。

它不需要任何控制模型，直接使用参考图片就能引导扩散。

作者介绍，这个功能其实类似于“inpaint”功能，但不会让图像崩坏。

（Inpaint是Stable Diffusion web UI中的一个局部重绘功能，可以将不满意、也就是被手工遮罩的地方进行重新绘制。）

一些资深玩家可能都知道一个trick，就是用inpaint来进行图像扩散。

比如你有一张512x512的狗的图像，然后想用同一只狗生成另一张512x512的图像。

这时你就可以将512x512的狗图像和512x512的空白图像连接到一张1024x512的图像中，然后使用inpaint功能，mask掉空白的512x512部分，漫射出具有相似外观的狗的形象。

在这个过程中，由于图像只是简单粗暴的进行拼接，加上还会出现失真现象，所以效果一般都不尽如人意。

有了“reference-only”就不一样了：

它可以将SD（即“Stable Diffusion”）的注意力层直接链接到任何独立的图像，方便SD直接读取这些图像作为参考。

也就是说，现在你想要在保持原图风格的前提下进行修改，使用提示词直接在原图上就能操作。

如官方示例图将一只静立的小狗改成奔跑动作：

你只需要将你的ControlNet升级到1.1.153版本以上，然后选择“reference-only”作为预处理器，上传狗的图片，输入提示词“a dog running on grassland, best quality……”，SD就只会用你的这张图作为参考进行修改了。

网友：ControlNet迄今最好的一个功能

“reference-only”功能一出，有不少网友就上手体验了。

有人称这是ControlNet迄今为止最棒的一个功能：

传一张带有人物姿势的动漫图片，再写一句看上去跟原图完全无关的提示。突然之间，你想要的效果就在原图的基础上跑出来了。真的很强，甚至说是达到了改变游戏规则的程度。

还有人称：

是时候把以前丢弃的废图都捡回来重新修复一下了。

当然，认为它也不是那么完美也有（比如开头第一张效果图里美女的耳环不对，二张图里头发也都是残缺的），但网友还是表示“总归方向是对了”。

以下是三位推特博主尝试的效果，主要都是动漫风，一起欣赏一下：

△来自@新宮ラリのAIイラストニュ

△来自@br_d，左一为原图

△来自@br_d，上一为原图

△来自@uoyuki667，左一为原图

有没有戳中你的心巴？

参考链接：
[1]https://github.com/Mikubill/sd-webui-controlnet/discussions/1236
[2]https://twitter.com/sundyme/status/1657605321052012545
[3]https://twitter.com/uoyuki667/status/1657748719155167233
[4]https://twitter.com/br_d/status/1657926233068556289
[5]https://twitter.com/aiilustnews/status/1657941855773003776

点击进入—>【Transformer】微信技术交流群

最新CVPR 2023论文和代码下载

后台回复：CVPR2023，即可下载CVPR 2023论文和代码开源的论文合集

后台回复：Transformer综述，即可下载最新的3篇Transformer综述PDF

目标检测和Transformer交流群成立
扫描下方二维码，或者添加微信：CVer333，即可添加CVer小助手微信，便可申请加入CVer-目标检测或者Transformer 微信交流群。另外其他垂直方向已涵盖：目标检测、图像分割、目标跟踪、人脸检测&识别、OCR、姿态估计、超分辨率、SLAM、医疗影像、Re-ID、GAN、NAS、深度估计、自动驾驶、强化学习、车道线检测、模型剪枝&压缩、去噪、去雾、去雨、风格迁移、遥感图像、行为识别、视频理解、图像融合、图像检索、论文投稿&交流、PyTorch、TensorFlow和Transformer等。
一定要备注：研究方向+地点+学校/公司+昵称（如目标检测或者Transformer+上海+上交+卡卡），根据格式备注，可更快被通过且邀请进群

▲扫码或加微信号: CVer333，进交流群
CVer计算机视觉（知识星球）来了！想要了解最新最快最好的CV/DL/AI论文速递、优质实战项目、AI行业前沿、从入门到精通学习教程等资料，欢迎扫描下方二维码，加入CVer计算机视觉，已汇集数千人！

▲扫码进星球
▲点击上方卡片，关注CVer公众号

整理不易，请点赞和在看