重大模型发布已确认
OpenAI 发布 Whisper
OpenAI 发布并开源 Whisper 自动语音识别模型。模型支持多语言转写、语言识别和语音到英语的翻译。
OPOpenAI已核验来源
想引用重要AI新闻?随时能找到。
事件详情
OpenAI 于 2022 年 9 月 21 日发布 Whisper。该模型在 68 万小时多语言、多任务监督数据上训练,采用编码器—解码器 Transformer 架构,可执行多语言语音转写、语言识别和非英语语音到英语的翻译。OpenAI 同时公开模型权重和推理代码。
影响评估
Whisper 提供了可本地部署的多语言语音识别与翻译能力,并成为开源语音处理生态的重要基础模型。
技术影响4/5
能力、架构、训练方法或研究路线的推动程度
市场影响4/5
产品采用、商业模式和行业竞争格局的变化
生态影响5/5
对开发者、开源社区、平台和上下游的带动
政策与社会2/5
监管、安全、劳动方式和公众认知层面的影响
影响范围5/5
事件影响从局部团队扩展到全球行业的广度
持续性5/5
影响是否会沉淀为长期能力、惯例或结构性变化