生成并导出音频
生成就是把每个片段的文本变成声音。你需要两样东西:写好的片段,以及给每个角色分配好的声音。之后就可以逐个片段生成,或者一次性全部生成,听一听结果,再把它导出成一个文件,或者一个个单独的片段。
生成单个片段
每个片段都有一个“生成”按钮,会用该角色的声音和服务商生成它的音频。生成之后,你可以播放、下载,或者删除音频以便重新生成。
批量生成
“生成全部待生成片段”会一次性处理所有还没有音频的片段,并逐个显示进度。这是快速生成整个项目的方式。
调用日志
日志面板保存着调用语音合成服务商的历史记录:哪些成功、哪些失败、各用了多长时间。排查生成错误时很有用。
生成时常见的错误
“该角色还没有分配声音”:在“项目设置”里少了这项分配。“请在设置中配置 … API 密钥”:这个角色所用服务商的密钥没有保存在这个浏览器里。“已达到请求频率上限,请稍等片刻”:每分钟最多十次请求,等一会儿再试。“语音合成失败”是通用消息;使用 TTS Local 服务商时,它几乎总是意味着桌面应用的服务器没有启动。
导出音频
音频生成之后,可以按你的需要用几种方式导出:
生成完整音频(WAV 或 MP3)
“生成完整音频”会把所有片段拼成一个音频文件。你可以选 WAV 格式(音质最好)或 MP3 格式(体积更小,便于分享)。
音频是什么格式,文件怎么命名
所有音频都以 24000 Hz、单声道、16 位的 WAV 生成。WAV 的完整音频沿用这个格式;MP3 则以 128 kbps 编码。文件名来自项目标题:“Fireside Stories” 会得到 fireside-stories-master.wav,ZIP 则是 fireside-stories-clips.zip,里面每个片段一个文件,命名像 001-Marta.wav,位置编号补足三位。完整音频把片段一个接一个拼起来,中间不加静默:想要停顿,就到时间轴上混编这一集。
删除全部音频
在操作栏里可以一次性删除项目中所有片段已生成的音频,文本会保留,方便你从头重新生成。