DALL·E

美国图像生成系统

DALL·E

DALL·E是2021年1月美国人工智能非营利组织OpenAI推出的图像生成系统。通过接收文本和图像作为包含最多1280个标记的单个数据流,并使用最大似然进行训练,以逐个生成所有标记。DALL·E可以根据用户提供的简单描述创建较为逼真和清晰的图像,同时也可以根据文字来制作建筑物上的标志。[0][1]2021年1月,美国人工智能非营利组织OpenAI推出书面文字生成图像的人工智能系统DALL·E。[0][1]2022年9月29日,OpenAI取消了访问其文本生成图像系统DALL·E 2的等待名单。[2]2024年2月7日,OpenAI宣布其图像生成器DALL·E 3开始为所生成的图像添加来自内容来源和真实性联盟 (C2PA) 的水印。[3]

DALL·E是2021年1月美国人工智能非营利组织OpenAI推出的图像生成系统。通过接收文本和图像作为包含最多1280个标记的单个数据流,并使用最大似然进行训练,以逐个生成所有标记。DALL·E可以根据用户提供的简单描述创建较为逼真和清晰的图像,同时也可以根据文字来制作建筑物上的标志。[1][2]

2021年1月,美国人工智能非营利组织OpenAI推出书面文字生成图像的人工智能系统DALL·E。[1][2]2022年9月29日,OpenAI取消了访问其文本生成图像系统DALL·E 2的等待名单。[3]2024年2月7日,OpenAI宣布其图像生成器DALL·E 3开始为所生成的图像添加来自内容来源和真实性联盟 (C2PA) 的水印。[4]

2021年4月,DALL·E入选由技术领域全球知名大学组成的Netexplo大学网络历时一年,在全球范围内遴选出的10项极具突破性的数字创新技术。[1]

名称由来

DALL·E来源于著名画家达利(Dalí)和机器人总动员(Wall-E)。[1][2]

发展历史

2021年1月,美国人工智能非营利组织OpenAI推出书面文字生成图像的人工智能系统DALL·E。[1][2]2022年9月29日,OpenAI取消了访问其文本生成图像系统DALL·E 2的等待名单,意味着任何人都可以注册使用这个人工智能艺术生成器。[3]次年10月3日,微软官网宣布,OpenAI最新的DALL·E 3模型现面向所有Bing Chat和Bing Image Creator用户开放。DALL·E 3是OpenAI图像生成模型的第三个版本。[2][5]

2024年2月7日,OpenAI宣布,其图像生成器DALL·E 3开始为所生成的图像添加来自内容来源和真实性联盟 (C2PA) 的水印,以帮助用户识别使用人工智能 (AI) 生成的内容。[2][4]

功能特点

DALL·E可以根据用户提供的简单描述创建较为逼真和清晰的图像,该系统熟悉各种艺术风格,其中包括插画和风景等。它还可以根据文字来制作建筑物上的标志,并分别制作同一场景的草图和全彩图像。[1][2]

DALL·E具有不同程度的可靠性,可通过自然语言访问3D渲染引擎功能的子集。它可以独立控制少量对象的属性,并在有限的范围内控制对象的数量以及它们之间的排列方式。它还可以控制渲染场景的位置和角度,并可以根据精确的角度和照明条件规范生成已知对象。[2]

相关事件

2024年2月15日,OpenAI发布了最新的视频生成模型Sora,Sora采用了OpenAI文生图模型DALL·E 3背后的技术,可将简短的文本描述转化成长达1分钟的高清视频。[6]

图/OpenAI 官网,为 Sora 生成的视频,部分截取
图/OpenAI 官网,为 Sora 生成的视频,部分截取

所获荣誉

honor2021年全球十大数字创新技术
time2021年4月[1]
type

参考资料 6

  1. 十大数字创新技术出炉 中国“九章”榜上有名 — 人民网
  2. DALL·E: Creating images from text — OpenAI
  3. OpenAI 文本生成图像工具 DALL-E 取消排队,任何人均可立即使用 — IT之家
  4. OpenAI 宣布 DALL-E 3 图像生成器将加入水印,助用户识别 AI 生成内容 — IT之家
  5. 微软宣布DALL-E 3模型面向所有Bing Chat用户开放 — 界面新闻
  6. 炸裂 | Sora来了!潘多拉的魔盒被打开? — 澎湃新闻
广告位:底部(ad-bottom)—— 请到中台「公共区块」编辑此内容