注意！ChatGPT 全新 AI 图像功能延迟对免费用户开放

Ztop

已于 2025-03-27 14:53:36 修改

阅读量451

点赞数 2

分类专栏： chatgpt 文章标签： chatgpt 人工智能

于 2025-03-27 13:15:02 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/ONE_ZJC/article/details/146555562

版权

chatgpt 专栏收录该内容

22 篇文章

订阅专栏

2025 年 3 月 25 日，OpenAI 正式宣布在 ChatGPT 中推出基于 GPT-4o 模型的全新原生图像生成功能。

这一功能允许用户通过对话生成和编辑图像，支持从写实风格到插图风格的多种形式。OpenAI 首席执行官萨姆・奥特曼（Sam Altman）在社交平台 X 上表示，该技术是公司的一项重大突破，首批图像生成结果令人惊叹。

新功能的亮点包括：

能够精确渲染文本内容，提供高质量的图像效果。
支持多种输入输出方式，涵盖文本、图像和音频等多种形式。
理解复杂指令并结合上下文，创造出具有真实感的第一人称视角图像。

与之前的图像生成模型 DALL・E 不同，GPT-4o 采用了一种自回归模型，原生嵌入在 ChatGPT 中。这意味着，它能够处理多达 10 至 20 个不同物体的复杂指令，而竞争对手通常只能处理 5 至 8 个，展现出更强的能力。

用户只需简洁地描述需求，比如指定纵横比、颜色或透明背景，模型便可以快速生成图像。虽然渲染较复杂的细节可能需要稍等一会儿，但最终的效果是值得的。

改进之后的AI图像功能更容易地创建逼真的图片，生成的模式逻辑也与以往的不同，类似于文本书写，是按照从左到右，从上到下的顺序来生成图像，以往的扩散技术是一次性生成整个图像。

在一次发布会上，演示者展示了多个具体案例。比如，他将一张合影转化为动漫风格的图像，模型不仅成功保留了人物的特征，还完美融合了动漫视觉效果。

此外，演示者要求生成一页关于相对论的幽默漫画，结果生成的漫画不仅结构完整，还生动有趣。

OpenAI 对此功能的安全性也非常重视，所有生成的图像都带有 C2PA 元数据标识，确保内容的来源可追溯，并有效阻止不当请求的生成。

当然，OpenAI 的图像生成工具并非没有缺点，比如在裁剪、上下文理解和非拉丁文本渲染等方面仍存在不足。不过，OpenAI 表示他们会在未来不断优化这些问题。

但由于用户的需求远远超出了公司的预期，ChatGPT原先计划该功能会向所有用户开放，也会随之推迟。目前，OpenAI 只向 ChatGPT Pro、Plus 和 Teams 的订阅用户推出了这一功能。 Sam Altman表示：“ChatGPT 中的图像功能比我们想象的要受欢迎得多（而且我们的预期已经很高了）。”

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

Ztop 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。