GP

MODEL

GPT-4o Transcribe

OpenAI 的 GPT-4o 语音转文本模型,相比 Whisper 改善词错误率、语言识别和复杂声学条件下的准确性。语音能力:streaming=true(API);localDeploy=false;speakerDiarization=none;speakerIdentification=none;overlappingSpeech=unknown;timestamps=segment。

发布日期:
2025-03-20
参数量:
未公开
架构:
GPT-4o 驱动的 speech-to-text 模型
输入输出:
音频 → 文本
交互方式:
流式输出
开放方式:
闭源
组织:
OpenAI
1 个相关事件

官方入口

ChatCode PlanAgent 工具API
全球

相关事件

按时间倒序整理已验证的发布与公司动态。