豆
豆包语音 TTS · 音色管理台
Doubao OpenSpeech Async Long Text Wrapper · v1.1
上传样本音频 · 训练克隆音色
样本要求:1~5 段 wav/mp3/mp4 音频,单段 5~60 秒,总时长建议 ≥ 30 秒,16kHz 以上清晰人声、无背景音乐、无噪音。
克隆任务进度
| 别名 |
task_id |
状态 |
speaker_id |
错误 |
提交时间 |
手动加入已克隆音色
如果你已经在火山控制台拿到克隆音色 ID(S_xxx / saturn_xxx / train_xxx),直接在这里登记,之后 TTS 可以用 nick_name 调用,避免记长 ID。
快速合成一段音频