AI画师技术又精进了 AI画师三维版试玩——Dreamfields和DreamFusion向文本生成3D模型领域进发(2)-CSDN博客

本文链接：https://blog.csdn.net/2401_84264536/article/details/138768169

本人从事网路安全工作12年，曾在2个大厂工作过，安全服务、售后服务、售前、攻防比赛、安全讲师、销售经理等职位都做过，对这个行业了解比较全面。

最近遍览了各种网络安全类的文章，内容参差不齐，其中不伐有大佬倾力教学，也有各种不良机构浑水摸鱼，在收到几条私信，发现大家对一套完整的系统的网络安全从学习路线到学习资料，甚至是工具有着不小的需求。

最后，我将这部分内容融会贯通成了一套282G的网络安全资料包，所有类目条理清晰，知识点层层递进，需要的小伙伴可以点击下方小卡片领取哦！下面就开始进入正题，如何从一个萌新一步一步进入网络安全行业。

学习路线图

其中最为瞩目也是最为基础的就是网络安全学习路线图，这里我给大家分享一份打磨了3个月，已经更新到4.0版本的网络安全学习路线图。

相比起繁琐的文字，还是生动的视频教程更加适合零基础的同学们学习，这里也是整理了一份与上述学习路线一一对应的网络安全视频教程。

网络安全工具箱

当然，当你入门之后，仅仅是视频教程已经不能满足你的需求了，你肯定需要学习各种工具的使用以及大量的实战项目，这里也分享一份我自己整理的网络安全入门工具以及使用教程和实战。

项目实战

最后就是项目实战，这里带来的是SRC资料&HW资料，毕竟实战是检验真理的唯一标准嘛~

面试题

归根结底，我们的最终目的都是为了就业，所以这份结合了多位朋友的亲身经验打磨的面试题合集你绝对不能错过！

网上学习资料一大堆，但如果学到的知识不成体系，遇到问题时只是浅尝辄止，不再深入研究，那么很难做到真正的技术提升。

需要这份系统化资料的朋友，可以点击这里获取

一个人可以走的很快，但一群人才能走的更远！不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人，都欢迎加入我们的的圈子（技术交流、学习资源、职场吐槽、大厂内推、面试辅导），让我们一起学习成长！

2.2、第二步：连接Google云端硬盘

点击check the machine的运行按钮
在这里插入图片描述
代码需要连接Google云端硬盘读写文件，点击连接。

2.3、第三步：配置参数开始运行

配置一下training和test的设置参数，保存格式有视频和网格两种，输出模型格式为带顶点色的obj和ply。如果你只是简单试玩，可以选择不动他的参数。
在这里插入图片描述
然后依次点击运行按钮就可以开始试玩了，初始训练轮数为200轮，每轮运行时间大概需要1分钟，每10轮会进行一次输出，可以观看每10轮的效果：

等待训练完成后，就可以输入自己想要的文本来生成3D模型啦。

3、DreamFusion 原理分析

上节我们体验的是Dreamfields-3D，可以看到虽然可以生成模型，但是看起来效果并不是很好，风格比较诡异，而前不久Google Research在Dreamfields-3D基础上做了改进，发布了最新成果DreamFusion，让生成模型的形态、颜色、光线、密度有巨大的飞跃，虽然 Dreamfusion 还未开放使用，但项目网站提供了生成画廊：DreamFusion预览地址
在这里插入图片描述
要直接训练一个text-to-3D的模型非常困难，因为DALL-E 2等模型的训练需要吞噬数十亿个图像-文本对，但并不存在如此大规模的3D标注数据，目前也没有一个高效的模型架构对3D数据进行降噪。DreamFusion先使用一个预训练2D扩散模型基于文本提示生成一张二维图像，然后引入一个基于概率密度蒸馏的损失函数，通过梯度下降法优化一个随机初始化的神经辐射场NeRF模型。

在DreamFusion中，使用了一个预先训练的二维文本到图像扩散模型，扩散模型是潜在变量生成模型，它学习将样本从可控制的噪声分布逐渐转换为数据分布。
在这里插入图片描述
评分蒸馏采样的损失函数叫SDS，其代替CLIP通过文本到图像的Imagen扩散模型来计算损失。用评分蒸馏采样来表示生成过程中的损失，通过不断优化最小化这种损失，
通过优化实现可控制的采样，从而输出质量良好的3D模型。

除此之外，与Dream Fields相比，Dreamfusion通过文本提示生成高质量、深度和普通的背光3D对象。使用Dreamfusion生成的多个3D模型也可以缝合到一个场景中，比如下图，迭代地细化一个示例文本提示，同时从四个不同的方面渲染每个生成的场景：
在这里插入图片描述
Dreamfusion从随机的相机位置和角度反复渲染NeRF的视图，用这些渲染结果作为环绕Imagen的分数蒸馏损失函数的输入。每次迭代都包含四步：①随机采样一个相机和灯光；②从该相机和灯光下渲染NeRF的图像；③计算SDS损失相对于NeRF参数的梯度；④使用优化器更新NeRF参数。