重大模型发布已确认

OpenAI 发布 Whisper

OpenAI 发布并开源 Whisper 自动语音识别模型。模型支持多语言转写、语言识别和语音到英语的翻译。

OPOpenAI已核验来源

想引用重要AI新闻?随时能找到。

事件详情

OpenAI 于 2022 年 9 月 21 日发布 Whisper。该模型在 68 万小时多语言、多任务监督数据上训练,采用编码器—解码器 Transformer 架构,可执行多语言语音转写、语言识别和非英语语音到英语的翻译。OpenAI 同时公开模型权重和推理代码。

影响评估

Whisper 提供了可本地部署的多语言语音识别与翻译能力,并成为开源语音处理生态的重要基础模型。

技术影响4/5

能力、架构、训练方法或研究路线的推动程度

市场影响4/5

产品采用、商业模式和行业竞争格局的变化

生态影响5/5

对开发者、开源社区、平台和上下游的带动

政策与社会2/5

监管、安全、劳动方式和公众认知层面的影响

影响范围5/5

事件影响从局部团队扩展到全球行业的广度

持续性5/5

影响是否会沉淀为长期能力、惯例或结构性变化