文字转语音 TTS 使用说明
本工具调用浏览器内置的 Web Speech API(window.speechSynthesis)把文字朗读出来, 全部在本地完成,文本不会上传到任何服务器,也不消耗网络流量。
基本使用
1. 在“待朗读文本”中输入或粘贴文字,中英文混排均可。
2. 在“音色”下拉框中挑选一个语音。列表来自操作系统安装的语音包,不同系统差异很大:Windows 通常有中文“Huihui / Yaoyao”与多个英文音色,macOS 与 iOS 有“婷婷 / Meijia”等,Android 依赖 Google 语音服务。
3. 调整语速、音高、音量后点击“开始朗读”。朗读过程中可随时暂停、继续或停止。
参数含义
语速:0.5 为半速,1 为正常,2 为两倍速。中文播报建议 0.9 到 1.2 之间最自然。
音高:0 最低沉,1 为默认,2 最尖细。部分系统音色会忽略该参数。
音量:0 到 1,作用于本次朗读,不改变系统音量。
音色列表为空怎么办
语音包由系统异步加载,页面刚打开时列表可能是空的,等待一两秒或点击“刷新音色”即可。 如果始终为空,说明设备没有安装任何语音包:Windows 可在“设置 - 时间和语言 - 语音”中添加, Linux 桌面通常需要额外安装 speech-dispatcher 与语音数据。此时留空音色项,直接朗读会使用系统默认发音。
为什么不能导出音频文件
这是 Web Speech API 的设计限制,而不是本工具的缺失。合成后的声音由浏览器交给操作系统播放, 网页脚本拿不到对应的 PCM 数据,也无法接入 MediaRecorder 录制,所以任何纯前端 TTS 工具都无法直接产出音频文件。 需要成品音频时,请使用系统录音工具录制内录声音,或选择提供文件下载的服务端合成方案。
常见问题
点了没声音:部分浏览器要求先有用户交互才允许发声,请确认是通过点击按钮触发;同时检查系统音量与页面是否被静音。
长文本读到一半停止:某些浏览器对单条语音的长度有限制,建议把长文分成若干段分别朗读。
切换音色不生效:语音参数在朗读开始时锁定,请先停止再重新朗读。