关键模型发布已确认
Google 上线 Gemini 3.8 Flash TTS,增强声音设计与语音表现控制
Gemini 3.8 Flash TTS 在 Gemini API 和 Google AI Studio 正式可用,重点改善语音保真度、表演控制、地区口音及长篇声音稳定性,支持多人语音和自定义声音工作流。
GOGoogle DeepMind已核验来源
想引用重要AI新闻?随时能找到。
事件详情
Google Gemini API 发布说明将 Gemini 3.8 Flash TTS 正式上线日期记为 2026 年 9 月 22 日,9 月 23 日另发布 TTS 家族博客公告。 Flash TTS 面向创作和配音,改善语音保真度、地区口音及长篇多人对话的声音稳定性。声音设计和经同意验证的声音复刻通过配套接口提供。Gemini Enterprise API 尚为后续计划。
影响评估
Google 更新正式可用的 TTS 模型系列,将声音设计、复刻和多人语音控制纳入开发者工作流。
技术影响3/5
能力、架构、训练方法或研究路线的推动程度
市场影响3/5
产品采用、商业模式和行业竞争格局的变化
生态影响4/5
对开发者、开源社区、平台和上下游的带动
政策与社会2/5
监管、安全、劳动方式和公众认知层面的影响
影响范围4/5
事件影响从局部团队扩展到全球行业的广度
持续性3/5
影响是否会沉淀为长期能力、惯例或结构性变化