Datawhale X 魔搭 AI夏令营task3笔记

最新推荐文章于 2024-10-27 07:57:56 发布

hello_world5912

最新推荐文章于 2024-10-27 07:57:56 发布

阅读量868

点赞数 13

文章标签：笔记

本文链接：https://blog.csdn.net/z1234_5_/article/details/141283212

版权

Part1 工具准备 ComfyUI

ComfyUI简介

ComfyUI核心模块

Stable Diffusion的基本原理

Part1 工具准备 ComfyUI

ComfyUI简介

它是GUI的一种，是基于节点工作的用户界面，主要用于操作图像的生成技术，ComfyUI 的特别之处在于它采用了一种模块化的设计，把图像生成的过程分解成了许多小的步骤，每个步骤都是一个节点。这些节点可以连接起来形成一个工作流程，这样用户就可以根据需要定制自己的图像生成过程。

ComfyUI核心模块

模型加载器、提示词管理器、采样器、解码器

Stable Diffusion的基本原理

通过降噪的方式（如完全的噪声图像），将一个原本的噪声信号变为无噪声的信号（如人可以理解的图像）。其中的降噪过程涉及到多次的采样。采样的系数在KSampler中配置：

seed：控制噪声产生的随机种子
control_after_generate：控制seed在每次生成后的变化
steps：降噪的迭代步数，越多则信号越精准，相对的生成时间也越长
cfg：classifier free guidance决定了prompt对于最终生成图像的影响有多大。更高的值代表更多地展现prompt中的描述。
denoise: 多少内容会被噪声覆盖 sampler_name、scheduler：降噪参数。

ComfyUI图片生成流程

ComfyUI的优势

模块化和灵活性：ComfyUI 提供了一个模块化的系统，用户可以通过拖放不同的模块来构建复杂的工作流程。这种灵活性允许用户根据自己的需求自由组合和调整模型、输入、输出、和其他处理步骤。
可视化界面：ComfyUI 提供了直观的图形界面，使得用户能够更清晰地理解和操作复杂的 AI 模型和数据流。这对没有编程背景的用户特别有帮助，使他们能够轻松构建和管理工作流程。
多模型支持：ComfyUI 支持多个不同的生成模型，用户可以在同一平台上集成和切换使用不同的模型，从而实现更广泛的应用场景。
调试和优化：通过其可视化界面，ComfyUI 使得调试生成过程变得更简单。用户可以轻松地追踪数据流，识别并解决问题，从而优化生成结果。
开放和可扩展：ComfyUI 是一个开源项目，具有高度的可扩展性。开发者可以根据需要编写新的模块或插件，扩展系统功能，并根据项目需求进行定制。
用户友好性：尽管其功能强大，但 ComfyUI 仍然保持了用户友好性，即使对于复杂任务，也能以相对简单的方式完成，使其成为生成式 AI 工作流程管理的有力工具。

Part2 ComfyUI实践

新建终端，输入以下指令git lfs install 
git clone https://www.modelscope.cn/datasets/maochase/kolors_test_comfyui.git 
mv kolors_test_comfyui/* ./ 
rm -rf kolors_test_comfyui/ 
mkdir -p /mnt/workspace/models/lightning_logs/version_0/checkpoints/ 
mv epoch=0-step=500.ckpt /mnt/workspace/models/lightning_logs/version_0/checkpoints/