DALL·E2 页面截图
产品页面 点击查看大图

DALL·E2

DALL·E2 是 OpenAI 的图像生成工具系列,其基础模型 DALL·E 能够根据自然语言文本说明创建图像,覆盖广泛概念;后续版本 DALL·E 2 可生成更真实、分辨率高 4 倍的图像。

人工智能绘画AI绘画绘画工具
01

Overview

产品概述

DALL·E 是 OpenAI 训练的一个 120 亿参数 Transformer 语言模型,使用文本-图像对数据集进行训练。它将文本和图像作为最多 1280 个 token 的单流数据,以最大似然方式逐 token 生成。除了从零生成图像,它还能根据文本提示重绘现有图像中延伸到右下角的矩形区域。OpenAI 指出其具有多样能力,包括创建拟人化动物与物体、以合理方式组合无关概念、渲染文本以及变换现有图像。
02

Capabilities

核心能力

01

文本到图像生成

能够针对自然语言描述的广泛概念生成合理的图像,并利用语言组合结构创建多种场景。

02

控制对象属性与空间关系

能够控制少量对象的属性、数量及排列方式,也可控制场景的视角与三维感,还能根据文本提示重绘已有图像的矩形区域。

03

组合概念与艺术创作

能够将无关概念合理组合,生成拟人化动物与物体、动物嵌合体、表情符号等艺术插画。

03

Use Cases

适用场景

  1. 01

    艺术插画与概念设计

    可用于生成拟人化对象、动物嵌合体、表情符号以及融合不同概念的创意插图。

  2. 02

    时尚与室内设计

    可将文本生成图像的能力应用于时尚搭配和室内设计场景的探索。

  3. 03

    零样本视觉推理

    可执行多种图像到图像的翻译任务,并被用于瑞文推理测验等类比推理测试。