ControlNet大更新：仅靠提示词就能精准P图，网友：效果堪比定制大模型

最新推荐文章于 2024-09-27 10:58:53 发布

深度学习技术前沿

最新推荐文章于 2024-09-27 10:58:53 发布

阅读量130

点赞数

文章标签：人工智能计算机视觉

原文链接：https://mp.weixin.qq.com/s?__biz=MzU2NDExMzE5Nw==&mid=2247530168&idx=3&sn=71111d42bc65b3c38cfb0654c6ffae37&chksm=fc4dccfacb3a45ecc897b1e883bc39958ce285bba6a4c4aacb6406e392378b1e23f9218d9c8d&scene=126&sessionid=0

版权

ControlNet和StableDiffusion插件的最新更新允许用户通过文本提示在保持图像原有风格的同时修改细节，如人物造型、表情和场景。这一“reference-only”预处理器功能类似于inpaint，但提供更好的图像保真度。用户反馈该功能强大且有潜力，可将旧图像重构成新作品。

摘要由CSDN通过智能技术生成

来源“量子位”

Stable Diffusion插件、“AI绘画细节控制大师”ControlNet迎来重磅更新：

只需使用文本提示词，就能在保持图像主体特征的前提下，任意修改图像细节。

比如给美女从头发到衣服都换身造型，表情更亲和一点：

抑或是让模特从甜美邻家女孩切换到高冷御姐，身体和头部的朝向、背景都换个花样儿：

——不管细节怎么修改，原图的“灵魂”都还在。

除了这种风格，动漫类型的它也能驾驭得恰到好处：

来自推特的AI设计博主@sundyme就称：

效果比想象得要好！

只需要一张参考图就能完成以上转变，部分图片几乎可以达到定制大模型的效果了。

咳咳，各位AI绘画圈的朋友们，打起精神来，又有好玩的了。

（ps. 第一三张效果图来自油管博主@Olivio Sarikas，第二张来自推特博主@sundyme）

ControlNet上新：保留原图画风的修图功能

以上更新内容，其实指的是一个叫做“reference-only”的预处理器。

它不需要任何控制模型，直接使用参考图片就能引导扩散。

作者介绍，这个功能其实类似于“inpaint”功能，但不会让图像崩坏。

（Inpaint是Stable Diffusion web UI中的一个局部重绘功能，可以将不满意、也就是被手工遮罩的地方进行重新绘制。）

一些资深玩家可能都知道一个trick，就是用inpaint来进行图像扩散。

比如你有一张512x512的狗的图像，然后想用同一只狗生成另一张512x512的图像。

这时你就可以将512x512的狗图像和512x512的空白图像连接到一张1024x512的图像中，然后使用inpaint功能，mask掉空白的512x512部分，漫射出具有相似外观的狗的形象。

在这个过程中，由于图像只是简单粗暴的进行拼接，加上还会出现失真现象，所以效果一般都不尽如人意。

有了“reference-only”就不一样了：

它可以将SD（即“Stable Diffusion”）的注意力层直接链接到任何独立的图像，方便SD直接读取这些图像作为参考。

也就是说，现在你想要在保持原图风格的前提下进行修改，使用提示词直接在原图上就能操作。

如官方示例图将一只静立的小狗改成奔跑动作：

你只需要将你的ControlNet升级到1.1.153版本以上，然后选择“reference-only”作为预处理器，上传狗的图片，输入提示词“a dog running on grassland, best quality……”，SD就只会用你的这张图作为参考进行修改了。

网友：ControlNet迄今最好的一个功能

“reference-only”功能一出，有不少网友就上手体验了。

有人称这是ControlNet迄今为止最棒的一个功能：

传一张带有人物姿势的动漫图片，再写一句看上去跟原图完全无关的提示。突然之间，你想要的效果就在原图的基础上跑出来了。真的很强，甚至说是达到了改变游戏规则的程度。

还有人称：

是时候把以前丢弃的废图都捡回来重新修复一下了。

当然，认为它也不是那么完美也有（比如开头第一张效果图里美女的耳环不对，二张图里头发也都是残缺的），但网友还是表示“总归方向是对了”。

以下是三位推特博主尝试的效果，主要都是动漫风，一起欣赏一下：

△ 来自@新宮ラリのAIイラストニュ

△来自@br_d，左一为原图

△来自@br_d，上一为原图

△来自@uoyuki667，左一为原图

有没有戳中你的心巴？

参考链接：
[1]https://github.com/Mikubill/sd-webui-controlnet/discussions/1236
[2]https://twitter.com/sundyme/status/1657605321052012545
[3]https://twitter.com/uoyuki667/status/1657748719155167233
[4]https://twitter.com/br_d/status/1657926233068556289
[5]https://twitter.com/aiilustnews/status/1657941855773003776

推荐阅读

欢迎大家加入DLer-计算机视觉技术交流群！

大家好，群里会第一时间发布计算机视觉方向的前沿论文解读和交流分享，主要方向有：图像分类、Transformer、目标检测、目标跟踪、点云与语义分割、GAN、超分辨率、人脸检测与识别、动作行为与时空运动、模型压缩和量化剪枝、迁移学习、人体姿态估计等内容。

进群请备注：研究方向+学校/公司+昵称（如图像分类+上交+小明）

👆 长按识别，邀请您进群！

深度学习技术前沿

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。