重大模型发布已确认

OpenAI 公布 GPT-2 并启动分阶段发布

OpenAI 公布最大 1.5B 参数的 GPT-2,但因滥用风险只先开放较小版本,由此启动持续九个月的分阶段发布实验。

OPOpenAI已核验来源

想引用重要AI新闻?随时能找到。

事件详情

OpenAI 公布 GPT-2:一个最大 1.5B 参数、使用约 40GB WebText 训练的 decoder-only 自回归 Transformer。模型以预测下一个 token 为单一目标,却能在问答、阅读理解、摘要和翻译等任务上表现出一定的零样本迁移能力;OpenAI 同时承认,这些下游结果通常仍低于专门训练的系统。 由于担忧模型被用于欺骗性、偏见或滥用内容,OpenAI 首发时只开放较小版本和采样代码,没有发布 1.5B 权重、训练代码或完整训练数据。该决定使“负责任发布”成为公开争论的一部分。后续评估既确认了偏见、微调滥用和检测困难,也没有发现强有力的现实滥用证据;OpenAI 最终在 2019 年 11 月发布完整 1.5B 权重。

影响评估

GPT-2 同时推动了零样本语言模型能力和模型发布治理的讨论;其分阶段开放成为此后权重发布、安全评估与社会风险争论的重要案例。

技术影响4/5

能力、架构、训练方法或研究路线的推动程度

市场影响4/5

产品采用、商业模式和行业竞争格局的变化

生态影响5/5

对开发者、开源社区、平台和上下游的带动

政策与社会5/5

监管、安全、劳动方式和公众认知层面的影响

影响范围4/5

事件影响从局部团队扩展到全球行业的广度

持续性4/5

影响是否会沉淀为长期能力、惯例或结构性变化

关联事件