DALL-E 是 OpenAI 推出的 AI 图像生成模型系列,只需输入一段文字描述,就能自动生成对应的图片。从初代到 DALL-E 3,它把「文生图」带入大众视野,并深度集成进 ChatGPT,是 AIGC 浪潮中最具代表性的产品之一。

| 类型 | AI 文本生成图像模型 |
| 开发商 | OpenAI |
| 推出时间 | 2021 年(初代) |
| 最新版本 | DALL-E 3 |
| 国家或地区 | 美国 |
| 官网 | openai.com |
DALL-E(也写作 DALL·E)是美国人工智能公司 OpenAI 开发的文本生成图像(文生图)模型系列,用户用自然语言描述画面,模型即可生成相应的图片。
DALL-E 的名字是一个文字游戏,由超现实主义画家萨尔瓦多·达利(Dalí)与皮克斯动画机器人瓦力(WALL-E)拼合而成,暗示它兼具艺术想象力与机器属性。初代模型于 2021 年首次亮相,首度向公众展示了「用一句话画一幅画」的可能性,例如生成「牛油果形状的扶手椅」这类现实中不存在的图像,引发广泛关注。
2022 年发布的 DALL-E 2 改用扩散模型(Diffusion Model)技术,画质与分辨率大幅提升,并支持局部重绘(Inpainting)和图像变体等编辑能力。2023 年的 DALL-E 3 则深度集成进 ChatGPT,用户可以用聊天的方式让 ChatGPT 帮忙润色提示词再作画,大幅降低了使用门槛,微软的 Bing 图像创建器(Image Creator)也采用了这一模型。此后 OpenAI 推出 GPT-4o 原生图像生成能力,逐步接棒 DALL-E 系列,但 DALL-E 作为文生图领域的开创性产品,影响力依然深远。
在文生图领域,DALL-E 与 Midjourney、Stable Diffusion 并称三大代表:Midjourney 以艺术感和氛围见长,Stable Diffusion 开源可本地部署、生态繁荣,而 DALL-E 的优势在于对自然语言的理解能力强、与 ChatGPT 无缝结合,适合没有专业绘画和提示词经验的普通用户。
问:DALL-E 免费吗?答:DALL-E 3 主要通过 ChatGPT 提供,付费订阅用户可直接使用;免费用户可通过微软必应的图像创建器等渠道体验,具体额度以官方政策为准。
问:DALL-E 生成的图片可以商用吗?答:按 OpenAI 的使用条款,用户对自己生成的图片拥有使用权,可用于商业用途,但需遵守内容政策,且 AI 生成图片的版权归属在不同国家法律上仍有争议。
问:DALL-E 和 Sora 有什么区别?答:两者都是 OpenAI 的生成式模型,DALL-E 生成静态图片,Sora 则是文本生成视频模型,可以看作从图像到视频的能力延伸。

| 类型 | AI 文本生成图像模型 |
| 开发商 | OpenAI |
| 推出时间 | 2021 年(初代) |
| 最新版本 | DALL-E 3 |
| 国家或地区 | 美国 |
| 官网 | openai.com |
登录 后参与讨论
暂无讨论,来发表第一条评论吧