软件使用手册合辑

安卓手机文字转语音怎么弄

想在安卓手机上把一段文字变成语音,现在有几种路子,各有各的适合场景。本篇把常见的几条路摆一遍,再说说用开源语音模型这条路该怎么走通;参数听感不对怎么调,看 文字转语音参数怎么调才自然.md。

一、先想清楚要哪种声音

手机上做文字转语音,大致三条路:

  1. 系统自带的朗读功能——设置里打开文字转语音(TTS)就能用,读个通知、验证码够用,但语气平、像机器人,做素材拿不出手;
  2. 在线配音工具——网页或小程序里粘文本选配音人,效果稳定,缺点是文案要传到别人服务器,长文本常要排队或限次;
  3. 本地跑开源语音模型——声音生成在手机本地完成,文案不出设备,语气也更像真人对话,代价是首次要装一个应用并等模型加载。

如果只是偶尔读一段话,第一条路最省事;要给视频配音、做听书内容这类反复用、讲究听感的场景,值得走第三条路。

二、开源对话语音这条路怎么走

开源社区里专为对话场景设计的代表是 ChatTTS:模型用大量中英文数据训练,擅长把日常口语读出停顿、语气词甚至笑声,而不是新闻播音腔。它原本要在电脑上配 Python 环境才能跑,现在有封装好的安卓端应用,装上就是一个输入框加几组滑块,不用碰命令行。

具体的界面长什么样、每一步点什么,ChatTTS 专题站的首页按「输入文本 → 挑音色 → 调参数 → 开始生成」四步截了图,照着走一遍就能出第一条语音。安装包的获取入口也在那个站的下载页,四步装完即可。

三、装好之后的第一条语音怎么出

第一条语音出来后,别急着堆参数。先把同一段文字多生成几次(换文本种子),感受一下模型本身的起伏,再去动 temperature 那些滑块,才知道每次改动听感差在哪。

同站更多文档

  1. 文字转语音参数怎么调才自然
  2. 语音合成能读出笑声和停顿吗