GP

MODEL

GPT-4o Transcribe Diarize

OpenAI 的内置说话人分离 ASR,输出带说话人标签和起止时间的片段,并可提供参考语者片段辅助已知语者标注。语音能力:streaming=false;localDeploy=false;speakerDiarization=native;speakerIdentification=reference_audio;overlappingSpeech=unknown;timestamps=segment。

发布日期:
2025-10-17
参数量:
未公开
架构:
GPT-4o ASR 与内置说话人分离
输入输出:
音频 → 文本
交互方式:
普通请求
开放方式:
闭源
组织:
OpenAI
1 个相关事件

官方入口

ChatCode PlanAgent 工具API
全球

相关事件

按时间倒序整理已验证的发布与公司动态。