🧠 模型与架构

DALL-E

DALL-EDALL-E 3DALL-E 2OpenAI DALL-EDALL·E

DALL-E 是 OpenAI 开发的文本到图像生成模型系列,能够根据文字描述生成高质量、富有创意的图片。DALL-E 3 是目前最新版本,在文本理解、图像质量和细节丰富度上达到了业界领先水平。


DALL-E 是什么?

DALL-E 是 OpenAI 推出的文生图模型系列,名字融合了超现实主义艺术家 Salvador Dalí 和 Pixar 的动画角色 WALL-E。DALL-E 能够根据自然语言描述生成原创的、高质量的图像,是 AI 绘画领域的开创性产品之一。

发展历程

DALL-E 1(2021 年 1 月):首次展示了 Transformer 架构在文生图任务上的潜力,使用 120 亿参数的 GPT-3 变体,生成 256x256 的图像,展示了强大的零样本图像生成能力。

DALL-E 2(2022 年 4 月):大幅提升图像质量和分辨率(1024x1024),引入扩散模型替代自回归生成,支持图像编辑和变体生成。

DALL-E 3(2023 年 10 月):与 ChatGPT 深度集成,用户可通过对话方式生成和优化图像,文本理解和图像质量达到业界领先水平。

与 ChatGPT 的集成

DALL-E 3 已深度集成到 ChatGPT 中,用户无需单独使用 DALL-E 界面,只需在 ChatGPT 对话中描述想要的图片,ChatGPT 会自动调用 DALL-E 3 生成。


相关术语

分享: