AUDIO ESTUDIO
登录免费创建账户

生成并导出音频

生成就是把每个片段的文本变成声音。你需要两样东西:写好的片段,以及给每个角色分配好的声音。之后就可以逐个片段生成,或者一次性全部生成,听一听结果,再把它导出成一个文件,或者一个个单独的片段。

生成单个片段

每个片段都有一个“生成”按钮,会用该角色的声音和服务商生成它的音频。生成之后,你可以播放、下载,或者删除音频以便重新生成。

批量生成

“生成全部待生成片段”会一次性处理所有还没有音频的片段,并逐个显示进度。这是快速生成整个项目的方式。

调用日志

日志面板保存着调用语音合成服务商的历史记录:哪些成功、哪些失败、各用了多长时间。排查生成错误时很有用。

生成时常见的错误

“该角色还没有分配声音”:在“项目设置”里少了这项分配。“请在设置中配置 … API 密钥”:这个角色所用服务商的密钥没有保存在这个浏览器里。“已达到请求频率上限,请稍等片刻”:每分钟最多十次请求,等一会儿再试。“语音合成失败”是通用消息;使用 TTS Local 服务商时,它几乎总是意味着桌面应用的服务器没有启动。

导出音频

音频生成之后,可以按你的需要用几种方式导出:

线性完整音频(WAV)
把所有片段按顺序拼成一个 WAV 文件,可以直接作为完整的一集发布。
片段 ZIP 包
把所有片段作为一个个单独的音频文件打包成 ZIP 下载,方便你分开编辑。
时间轴(多轨道)
把片段和音乐、音效一起摆到时间轴上,调好时间点,再把混音后的完整音频导出为 WAV。

生成完整音频(WAV 或 MP3)

“生成完整音频”会把所有片段拼成一个音频文件。你可以选 WAV 格式(音质最好)或 MP3 格式(体积更小,便于分享)。

音频是什么格式,文件怎么命名

所有音频都以 24000 Hz、单声道、16 位的 WAV 生成。WAV 的完整音频沿用这个格式;MP3 则以 128 kbps 编码。文件名来自项目标题:“Fireside Stories” 会得到 fireside-stories-master.wav,ZIP 则是 fireside-stories-clips.zip,里面每个片段一个文件,命名像 001-Marta.wav,位置编号补足三位。完整音频把片段一个接一个拼起来,中间不加静默:想要停顿,就到时间轴上混编这一集。

删除全部音频

在操作栏里可以一次性删除项目中所有片段已生成的音频,文本会保留,方便你从头重新生成。

用你自己的脚本试试

Free 套餐用 AI 声音生成音频,无需信用卡,也不用安装任何东西。