OpenAI一夜颠覆AI绘画！DALL·E 3+ChatGPT强强联合，画面直接细节爆炸

最新推荐文章于 2024-07-15 23:58:10 发布

我爱学AI

最新推荐文章于 2024-07-15 23:58:10 发布

阅读量798

点赞数 10

文章标签： AI作画 chatgpt 人工智能

本文链接：https://blog.csdn.net/python1234_/article/details/138603050

版权

起猛了，OpenAI竟然把AI绘画和ChatGPT合并了！

这不，最新发布的DALL·E 3，直接给AIGC带来了两大震撼——

提示词门槛极大降低
理解语意的细微差异的细节描述，准确到令人发指

在这里插入图片描述

没错，新版DALL·E 3，不仅省去了提示词工程，还顺带把语言理解能力提升了一个档次！

你只管随意想象。词，ChatGPT帮你拓展；画，DALL·E 3给你精确到细节。

AI就能像拍电影一般，保证从背景到人物，细节一字不差地复刻出来：

满月下的街道，熙熙攘攘的行人正在享受繁华夜生活。

街角摊位上，一位有着火红头发、穿着标志性天鹅绒斗篷的年轻女子，正在和脾气暴躁的老小贩讨价还价。

这个脾气暴躁的小贩身材高大，老道，身着一套整洁西装，留着引人注目的小胡子，正在用他那部蒸汽朋克式的电话兴致勃勃地交谈。

在这里插入图片描述

除了基础细节，DALL·E 3甚至能将模糊的形容词如繁华、讨价还价、脾气暴躁演绎得活灵活现，和CLIP已经不在一个档次了。

同时，相比上一代老模型，DALL·E 3自身的画技也前进了一大步：

在这里插入图片描述

这般操作，直接把网友看愣了。

有网友已经决定取消Midjourney订阅了。“如果Midjourney无法准确理解文本，这甚至称不上是同台竞技。”

在这里插入图片描述

还有网友调侃，这简直就是给即将到来的谷歌Gemini上压力。

在这里插入图片描述

更多细节，我们从DALL·E 3展示的效果一一来看。

在ChatGPT里直接用

相比前两代，DALL·E 3最大的优势在于原生构建在ChatGPT之上。

不仅意味着语言理解能力大幅飞跃，甚至提示词都可以让ChatGPT自己来写。

更多细节藏在奥特曼都忍不住自夸可爱的宣传视频里。

在这里插入图片描述

这是一个家长把5岁小朋友脑海里的幻想变成现实的故事。

首先家长询问ChatGPT，“我家5岁宝宝一直在说一个’超级向日葵刺猬’，它该长什么样？”

可以看到ChatGPT同时写了四段不同风格的提示词，并给出对应图像。

家长选择其中偏童话插图风格的一张后，故事的主角小刺猬形象似乎就能固定下来了，可以继续请ChatGPT画出更多。

顺便给小刺猬一个名字Larry，后面的对话中就不用每次都说“超级向日葵刺猬”了。

主角定好了，接下来再添加更多元素，让整个童话故事更丰富，比如给Larry画个房子。

这里既展示出了DALL·E 3创作一致形象的能力，也展示出邮箱上正确写上了LARRY的名字，解决了之前版本DALL·E不会写字的问题。

反正都用上ChatGPT了，不如把故事情节也完善一下？

刚编好的情节立马就可以有配套的插画了。

保持角色形象，迁移到完全不同的贴纸画风也没问题，可以直接打印出来。

注意了，最绝的地方来了，直接让ChatGPT总结前面对话中所有内容，写成一个完整的睡前故事。

虽然演示到此结束，但完全可以想象配合ChatGPT插件功能，还可以直接生成一本电子书出来。

就让人想起之前网友提议，确保AI安全的最佳方法是让OpenAI、Anthropic等公司的员工都有孩子。

这样他们就有动力确保AGI到来时世界是安全的。（手动狗头）

在这里插入图片描述

虽然DALL·E 3现在还不能马上玩到，一次放出的大量样张也可以先看个饱了。

在这里插入图片描述

每一张点开还可以看到提示词，都是直接用人话描述，没怎么加复杂咒语的那种。

在这里插入图片描述

复杂场景与不存在的概念组合，效果很惊艳。

在这里插入图片描述

搞室内设计概念图，光影明暗关系乍看也挑不出毛病。

在这里插入图片描述

配合正确写字能力，直出海报也是生产力拉满（没指定文字的小字部分还有些问题）。

在这里插入图片描述

刚加入OpenAI不久的德扑AI之父Noam Brown也晒出了他试玩的机器人打牌图。

在这里插入图片描述

CEO奥特曼最喜欢的则是这张“牛油果看医生”。

在这里插入图片描述

有网友去试了同样的提示词用在DALL·E 2的效果，只能说字也不对、牛油果中间的洞没话出来，治疗是更是没有……

在这里插入图片描述

还记得2021年1月DALL·E 1刚出的时候吗？梦开始的地方就是一组“牛油果做的沙发”。

也难怪网友感叹：看看它走了多远！

在这里插入图片描述

“如有侵权，请来删图”

当然，除了上述特性以外，OpenAI也预告了一些神奇的新功能。

例如，DALL·E 3即将配套推出一个图像鉴别器。

这个分类器可以帮助识别图像是否由DALL·E 3生成，不仅能避免误伤（手动狗头），也能在DALL·E创作出好作品时快速将它认领成自己的。

在这里插入图片描述

至于在生成图像上，OpenAI自述也做了大量工作，防止其生成暴力、色情或其他有害图片，或是带有公众人物（明星、名人等）姓名的图像生成。

关于隐私方面，之前纽约时报就曾爆料称，OpenAI正在通过某些技术，模糊掉上传到ChatGPT的图像中的人脸。

这也是为了避免ChatGPT变成一个彻底的“人脸识别工具”，尤其是已经有不少照片流传到互联网上的名人明星们。

如今这个技术可能也被用到了DALL·E 3中，防止生成侵权图像。

同时，OpenAI也与安全红队合作，提高了图像风险评估的能力。

除此之外，在训练数据上，有了Midjourney的“前车之鉴”，OpenAI这次也学会了保护自己。

相比于直接和画手打官司、或者等着被起诉，OpenAI在官网放出了一则训练数据“免责声明”：

您可以填写表格，禁止我们的网络爬虫GPTBot访问您的网站。或者，您也可以发送您想要保护隐私的图像，我们会把它从训练数据中删掉。

不过也有网友对DALL·E 3演示效果不满意，认为比不上MidJourney资深玩家出的图，OpenAI的资金可是充裕n多倍啊。

在这里插入图片描述

还有网友开启列文虎克模式，开始挨个挑演示图中漏掉的提示词细节。

比如这张杯子里缺少微型闪电。

在这里插入图片描述

这张散落在海底的只有大炮残骸，没有宝藏。

在这里插入图片描述

具体这些问题能不能通过调整提示词改善，就要等实际上手玩过才知道了。

那么DALL·E 3具体什么时候上线呢？划重点了：

ChatGPT Pro会员（20美元/月）和企业版在10月可用。

如何学习大模型 AI ？

由于新岗位的生产效率，要优于被取代岗位的生产效率，所以实际上整个社会的生产效率是提升的。

但是具体到个人，只能说是：

“最先掌握AI的人，将会比较晚掌握AI的人有竞争优势”。

这句话，放在计算机、互联网、移动互联网的开局时期，都是一样的道理。

我在一线互联网企业工作十余年里，指导过不少同行后辈。帮助很多人得到了学习和成长。

我意识到有很多经验和知识值得分享给大家，也可以通过我们的能力和经验解答大家在人工智能学习中的很多困惑，所以在工作繁忙的情况下还是坚持各种整理和分享。但苦于知识传播途径有限，很多互联网行业朋友无法获得正确的资料得到学习提升，故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。

在这里插入图片描述

第一阶段（10天）：初阶应用

该阶段让大家对大模型 AI有一个最前沿的认识，对大模型 AI 的理解超过 95% 的人，可以在相关讨论时发表高级、不跟风、又接地气的见解，别人只会和 AI 聊天，而你能调教 AI，并能用代码将大模型和业务衔接。

大模型 AI 能干什么？
大模型是怎样获得「智能」的？
用好 AI 的核心心法
大模型应用业务架构
大模型应用技术架构
代码示例：向 GPT-3.5 灌入新知识
提示工程的意义和核心思想
Prompt 典型构成
指令调优方法论
思维链和思维树
Prompt 攻击和防范
…

第二阶段（30天）：高阶应用

该阶段我们正式进入大模型 AI 进阶实战学习，学会构造私有知识库，扩展 AI 的能力。快速开发一个完整的基于 agent 对话机器人。掌握功能最强的大模型开发框架，抓住最新的技术进展，适合 Python 和 JavaScript 程序员。

为什么要做 RAG
搭建一个简单的 ChatPDF
检索的基础概念
什么是向量表示（Embeddings）
向量数据库与向量检索
基于向量检索的 RAG
搭建 RAG 系统的扩展知识
混合检索与 RAG-Fusion 简介
向量模型本地部署
…

第三阶段（30天）：模型训练

恭喜你，如果学到这里，你基本可以找到一份大模型 AI相关的工作，自己也能训练 GPT 了！通过微调，训练自己的垂直大模型，能独立训练开源多模态大模型，掌握更多技术方案。

到此为止，大概2个月的时间。你已经成为了一名“AI小子”。那么你还想往下探索吗？

为什么要做 RAG
什么是模型
什么是模型训练
求解器 & 损失函数简介
小实验2：手写一个简单的神经网络并训练它
什么是训练/预训练/微调/轻量化微调
Transformer结构简介
轻量化微调
实验数据集的构建
…

第四阶段（20天）：商业闭环

对全球大模型从性能、吞吐量、成本等方面有一定的认知，可以在云端和本地等多种环境下部署大模型，找到适合自己的项目/创业方向，做一名被 AI 武装的产品经理。

硬件选型
带你了解全球大模型
使用国产大模型服务
搭建 OpenAI 代理
热身：基于阿里云 PAI 部署 Stable Diffusion
在本地计算机运行大模型
大模型的私有化部署
基于 vLLM 部署大模型
案例：如何优雅地在阿里云私有部署开源大模型
部署一套开源 LLM 项目
内容安全
互联网信息服务算法备案
…

学习是一个过程，只要学习就会有挑战。天道酬勤，你越努力，就会成为越优秀的自己。

如果你能在15天内完成所有的任务，那你堪称天才。然而，如果你能完成 60-70% 的内容，你就已经开始具备成为一名大模型 AI 的正确特征了。

这份完整版的大模型 AI 学习资料已经上传CSDN，朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【`保证100%免费`】

123?spm=1001.2014.3001.5501)这份完整版的大模型 AI 学习资料已经上传CSDN，朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

在这里插入图片描述

我爱学AI

关注

10
点赞
踩
29

收藏

觉得还不错? 一键收藏
0
评论
OpenAI一夜颠覆AI绘画！DALL·E 3+ChatGPT强强联合，画面直接细节爆炸

起猛了，OpenAI竟然把和合并了！这不，最新发布的DALL·E 3，直接给AIGC带来了两大震撼——极大降低，准确到令人发指没错，新版DALL·E 3，不仅省去了提示词工程，还顺带把语言理解能力提升了一个档次！你只管随意想象。，ChatGPT帮你拓展；，DALL·E 3给你精确到细节。下的街道，熙熙攘攘的正在享受繁华夜生活。街角摊位上，一位有着、穿着标志性的年轻女子，正在和脾气暴躁的老小贩讨价还价。这个脾气暴躁的小贩身材高大，老道，身着一套整洁西装，留着引人注目的，正在用他那部。
复制链接

扫一扫