模型发布
GP1 个相关事件
MODEL
GPT-4o Transcribe
OpenAI 的 GPT-4o 语音转文本模型,相比 Whisper 改善词错误率、语言识别和复杂声学条件下的准确性。语音能力:streaming=true(API);localDeploy=false;speakerDiarization=none;speakerIdentification=none;overlappingSpeech=unknown;timestamps=segment。
- 发布日期:
- 2025-03-20
- 参数量:
- 未公开
- 架构:
- GPT-4o 驱动的 speech-to-text 模型
- 输入输出:
- 音频 → 文本
- 交互方式:
- 流式输出
- 开放方式:
- 闭源
- 组织:
- OpenAI
官方入口 | Chat | Code Plan | Agent 工具 | API |
|---|---|---|---|---|
| 全球 |
相关事件
按时间倒序整理已验证的发布与公司动态。