短视频口播与有声书配音实践
本篇讲文字转语音在两个最高频场景里的具体打法:短视频口播怎么让配音贴住画面节奏,有声书怎么分段生产、统一归档。工具以 ChatTTS 安卓版为例,流程对其他合成工具同样有参考价值。相关文档:文字转语音配音更自然的技巧 · 安卓版下载安装与快速上手
一、短视频口播:先生成,后剪画面
- 文案按「一屏一句」写。画面切换的位置就是配音停顿的位置;把文案按镜头切成短句,句与句之间用句号分隔,生成后再按镜头剪,节奏对得上。
- 先出音频、再铺画面。先把整段口播生成出来,听一遍确定总时长,再按音频长度去铺画面;反过来先剪画面,长度对不上时改起来更麻烦。
- 导出与导入。生成的音频保存到手机后,在剪映等剪辑软件里当普通音轨插入即可;配音就是普通音频文件,没有特殊格式要求。
- 念错只重做那一句。按段落拆开生成的好处在这里:数字念错、人名念歪,重做那一段就行,成本最低。
口播里出现产品名、英文缩写时,念法以实际生成为准;念得不顺就在文案里改写(比如把英文缩写展开成中文全称),比重试几次更有效。
二、有声书:分段生产、统一归档
- 按章节切分。一章一到三段,每段单独生成、单独保存,文件名带章节号(如「第03章_2」);哪段不满意重做哪段。
- 旁白与对白分开处理。纯旁白用一个音色保持连贯;对白多的章节可以按角色拆成几份文本、每个角色固定一个音色分别生成,再在剪辑软件里按台词顺序拼接——多一步拼接,换来的是每个角色的声音始终稳定。
- 章节衔接自己听。单段都没问题,拼起来可能有语速突变,重点听每章开头十秒,不顺就重生成那一段。
- 文件即作品。这类应用一般不提供云端作品库,生成的音频只存在手机本地;换手机前先把音频文件导出到网盘或电脑,顺手按「用途_序号」整理文件名。
三、成片前最后一道工序
干声直接铺进视频,合成感会全露出来。在剪辑软件里垫一层 5%~10% 音量的背景音乐或环境音,加到刚能察觉为止;低音量氛围声能盖住细微的机械感,对听感的改善比反复重生成划算。文案层还有哪些去机器味的手段,见 文字转语音配音更自然的技巧。
要动手却还没装好应用,从 安卓版下载安装与快速上手 开始;想先了解这款工具的功能与参数全貌,见 ChatTTS 安卓版介绍站。