重大模型发布已确认

OpenAI 公布 DALL·E 2 并启动受限研究预览

OpenAI 公布采用 CLIP 图像嵌入与扩散解码器的 DALL·E 2,并先向少量受邀用户开放研究预览。

OPOpenAI已核验来源

想引用重要AI新闻?随时能找到。

事件详情

DALL·E 2 采用两阶段文本条件图像生成架构:先验模型从文字生成 CLIP 图像嵌入,扩散解码器再从该嵌入生成图像;图像嵌入也可用于生成保留语义与风格的变体,并支持局部编辑和语言引导修改。相较初代,官方称其分辨率提高四倍;在两代模型对比中,评测者有 71.7% 更偏好其文字匹配,88.8% 更偏好其写实度。 首发不是公开注册:OpenAI 先向约 200 名艺术家、研究者和可信用户提供研究预览,再逐步扩容。早期产品限制暴力、仇恨、成人和政治内容,并限制生成真实人物的逼真面孔。取消等候名单和 API 公测属于后续独立可用性事件。

影响评估

DALL·E 2 把扩散生成、CLIP 对齐、图像变体与局部编辑结合成可逐步部署的创作系统,显著推动文生图进入大众产品阶段;同时,其分阶段开放和内容限制也成为生成图像治理的早期案例。

技术影响5/5

能力、架构、训练方法或研究路线的推动程度

市场影响5/5

产品采用、商业模式和行业竞争格局的变化

生态影响5/5

对开发者、开源社区、平台和上下游的带动

政策与社会4/5

监管、安全、劳动方式和公众认知层面的影响

影响范围5/5

事件影响从局部团队扩展到全球行业的广度

持续性4/5

影响是否会沉淀为长期能力、惯例或结构性变化