重大模型发布已确认

OpenAI 发布 GPT-4,并分阶段开放文字与图像能力

OpenAI 发布可接收文字和图像、输出文字的 GPT-4;文字能力进入 ChatGPT Plus 和 API 候补,图像输入仍限合作测试。

OPOpenAI已核验来源

想引用重要AI新闻?随时能找到。

事件详情

2023 年 3 月 14 日,OpenAI 发布 GPT-4。官方将它定义为可接收文字和图像、输出文字的多模态模型,并报告其在多项专业与学术考试、传统机器学习基准和多语言 MMLU 上优于 GPT-3.5;这些结果主要来自 OpenAI 自行组织的评测。首发 API 提供 8192-token 版本,并有限开放 32768-token 版本。 上线范围比“公开发布”更窄:ChatGPT Plus 用户受使用量上限约束,API 需要候补并分批邀请,图像输入仍是未公开的研究预览。OpenAI 同时承认 GPT-4 仍会产生幻觉、推理错误和有偏见的输出。技术报告只说明它是经过预训练和 RLHF 的 Transformer 风格模型,并明确不披露模型规模、具体架构、硬件、训练计算和数据构建;生产库原有“约 1.8T(MoE)”来自非官方传闻,现予删除。

影响评估

GPT-4 把更强的通用任务表现、多模态输入和系统消息控制带入 ChatGPT 与开发者 API,显著推动产品和应用升级。它的影响广泛且持续,但首发访问受限,技术透明度也明显低于公开权重模型。

技术影响5/5

能力、架构、训练方法或研究路线的推动程度

市场影响5/5

产品采用、商业模式和行业竞争格局的变化

生态影响4/5

对开发者、开源社区、平台和上下游的带动

政策与社会3/5

监管、安全、劳动方式和公众认知层面的影响

影响范围5/5

事件影响从局部团队扩展到全球行业的广度

持续性5/5

影响是否会沉淀为长期能力、惯例或结构性变化

关联事件

模型发布

OPOpenAI重大多模态

OpenAI 发布 GPT-4o

OpenAI 发布原生多模态模型 GPT-4o,支持文本、图像与音频的实时交互。