DA

MODEL

DALL·E 2

DALL·E 2 使用两阶段架构:先验模型根据文字生成 CLIP 图像嵌入,扩散解码器再据此生成图像;同一嵌入空间也支持图像变体、局部编辑和语言引导的视觉修改。它相对初代提高到四倍分辨率,并在官方对比中获得更高的文字匹配与写实度偏好。产品从小范围研究预览逐步扩展到网页和 API,但权重始终未开放;dall-e-2 API 快照已在 2026 年下线。

发布日期:
2022-04-06
参数量:
未公开
架构:
两阶段文本条件图像生成系统:先验模型由文本生成 CLIP 图像嵌入,再由扩散解码器从该嵌入生成图像
输入输出:
文本 + 图像 → 图像
交互方式:
普通请求
开放方式:
闭源
组织:
OpenAI
4 个相关事件

官方入口

ChatCode PlanAgent 工具API
全球

相关事件

按时间倒序整理已验证的发布与公司动态。

API 发布

OPOpenAI重大多模态

OpenAI 开放 DALL·E 2 API 公测

OpenAI 向所有 API 客户开放 DALL·E 图像生成与编辑能力,开发者可将 DALL·E 2 集成到应用和产品中。