OpenAI 发布 GPT-4,并分阶段开放文字与图像能力
OpenAI 发布可接收文字和图像、输出文字的 GPT-4;文字能力进入 ChatGPT Plus 和 API 候补,图像输入仍限合作测试。
想引用重要AI新闻?随时能找到。
事件详情
2023 年 3 月 14 日,OpenAI 发布 GPT-4。官方将它定义为可接收文字和图像、输出文字的多模态模型,并报告其在多项专业与学术考试、传统机器学习基准和多语言 MMLU 上优于 GPT-3.5;这些结果主要来自 OpenAI 自行组织的评测。首发 API 提供 8192-token 版本,并有限开放 32768-token 版本。 上线范围比“公开发布”更窄:ChatGPT Plus 用户受使用量上限约束,API 需要候补并分批邀请,图像输入仍是未公开的研究预览。OpenAI 同时承认 GPT-4 仍会产生幻觉、推理错误和有偏见的输出。技术报告只说明它是经过预训练和 RLHF 的 Transformer 风格模型,并明确不披露模型规模、具体架构、硬件、训练计算和数据构建;生产库原有“约 1.8T(MoE)”来自非官方传闻,现予删除。
影响评估
GPT-4 把更强的通用任务表现、多模态输入和系统消息控制带入 ChatGPT 与开发者 API,显著推动产品和应用升级。它的影响广泛且持续,但首发访问受限,技术透明度也明显低于公开权重模型。
能力、架构、训练方法或研究路线的推动程度
产品采用、商业模式和行业竞争格局的变化
对开发者、开源社区、平台和上下游的带动
监管、安全、劳动方式和公众认知层面的影响
事件影响从局部团队扩展到全球行业的广度
影响是否会沉淀为长期能力、惯例或结构性变化
关联事件
产品发布
OpenAI 以公开研究预览形式推出 ChatGPT
OpenAI 免费开放基于 GPT-3.5 系列、经监督微调与 RLHF 训练的对话产品 ChatGPT,并以真实用户反馈推进迭代部署。
模型发布