使用Stable Diffusion制作AI数字人视频-【Stable Diffusion 实战教程】

目录

1. StableDiffusion安装-请访问下面文章

2. StableDiffusion制作过程

3. SadTalker插件介绍

4. 使用StableDiffusion制作数字人视频的实际操作

5. 具体操作看下一篇文章


1. StableDiffusion安装-请访问下面文章

5分钟 Stable Diffusion 本地安装-本地部署(秋叶整合包)【Stable Diffusion 实战教程】_stable diffusion 秋叶整合包-CSDN博客

2. StableDiffusion制作过程

使用StableDiffusion制作AI数字人视频主要包括以下几个步骤:

  • 安装程序和模型:程序本身安装比较简单,但程序需要的模型搞起来比较复杂。作者单独打包了模型,需要从网盘下载。装完程序后,使用前还要下载模型和依赖包。

  • 生成工具的选择:生成工具使用StableDiffusionWebUI,模型选择realisticVisionV20,这个模型生成的图片看起来比较真实。

  • 采样器的选择:采样器这里选择DPM++2MSDEKarras,选择别的也没问题,只要生成一张人物照片就可以了。

  • 视频合成:这是最关键的一步,这里还是使用StableDiffusionWebUI,不过只是使用其中的一个插件,这个插件的名字就是SadTalker。SadTalker是Github上开源的,主要成员也都是国内的技术大佬。

3. SadTalker插件介绍

SadTalker模型是一个使用图片与音频文件自动合成人物说话动画的开源模型。给模型一张图片以及一段音频文件,模型会根据音频文件把传递的图片进行人脸的相应动作,比如张嘴,眨眼,移动头部等动作。它从音频中生成3DMM的3D运动系数(头部姿势、表情),并隐式调制一种新颖的3D感知面部渲染,用于生成说话的头部运动视频。

4. 使用StableDiffusion制作数字人视频的实际操作

  • 照片生成:这里介绍的方法需要使用比较真实的照片,如果太二次元了,视频人脸的效果会比较差。大家可以使用自己真实的照片,也可以使用StableDiffusion生成一张,也可以使用图生图稍微改造下自己的照片,总之要尽量真实一些。

  • 视频合成:在SDWebUI中通过扩展插件页面安装SadTalker插件。首先把文件下载到本地或者你的云环境,然后解压文件到stablediffusion webui的扩展目录,并拷贝几个文件到SD模型目录。

5. 具体操作看下一篇文章

使用sad talker制作AI数字人视频-【Stable Diffusion 实战教程】-CSDN博客

·

### 使用 Stable Diffusion 生成 AI 视频的方法 #### 工具介绍 为了实现基于 Stable DiffusionAI 数字人视频创作,可以采用两种主要工具:SadTalker 和 Temporal Kit 插件。 - **SadTalker** 是一种用于创建逼真面部动画的解决方案,能够根据输入的文字或音频自动生成对应的表情动作[^1]。 - **Temporal Kit** 则专注于增强图像序列的时间一致性,在保持视觉效果连贯性的前提下,允许用户轻松调整每一帧的内容并应用各种艺术滤镜[^2]。 #### 准备工作 无论是选择哪种方式来构建视频内容,都需要先准备好训练模型以及配置好运行环境。这通常涉及到安装 Python 环境及相关依赖库,并下载预训练好的权重文件以便后续调用。 对于 SadTalker 来说,还需要额外准备一段高质量的人脸图片作为模板;而对于想要利用 Temporal Kit 进行风格迁移操作,则建议收集一系列具有代表性的静态图样本来指导算法学习目标样式特征。 #### 创建过程 当一切就绪之后: 通过 SadTalker 构建动态人物形象时,只需上传一张正面清晰的人物照片及对应的语音素材即可自动合成流畅自然的动作片段; ```python from sadtalker import generate_video_from_audio_and_image generate_video_from_audio_and_image(audio_path="example.wav", image_path="portrait.jpg", output_dir="./output/") ``` 借助 Temporal Kit 处理现有影像资料以获得特定的艺术表现形式的话,可以通过简单的命令行指令指定源文件路径与期望的效果参数完成整个流程: ```bash temporal_kit --input video.mp4 --style style_name --output styled_output.avi ```
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值