SE

MODEL

Seed-TTS

ByteDance Seed 的语音生成基础模型,可根据参考语音和文本生成新语音,并控制音色、情绪、口音、方言及说话习惯。

发布日期:
2024-06-25
参数量:
未公开
架构:
语言模型与扩散式语音生成技术
输入输出:
文本 + 音频 → 音频
交互方式:
普通请求
开放方式:
闭源
组织:
ByteDance
1 个相关事件

官方入口

ChatCode PlanAgent 工具API
中国大陆
全球——

相关事件

按时间倒序整理已验证的发布与公司动态。

模型发布

BYByteDance重要多模态

ByteDance 公布 Seed-TTS

ByteDance Seed 公布语音生成基础模型 Seed-TTS 及其语音复刻和可控合成能力。