选择朗读方式
根据是否离线、是否追求音质、是否已有服务接口,选择适合自己的听书声音来源。
先按需求选择
| 你的情况 | 建议选择 | 说明 |
|---|---|---|
| 想马上听,不想注册服务 | 系统语音 | 最省事,声音质量取决于设备系统 |
| 想要更自然的声音 | 在线语音服务 | 需要配置密钥,可能产生第三方费用 |
| 已经有 Azure、阿里云、火山引擎、AWS、小米 MiMo 等账号 | 对应服务商语音 | 直接按服务商文档配置 |
| 已经在 Reeden 里配置了 AI 提供商 | AI 语音 | 复用 AI 提供商,调用它的语音合成接口 |
| 已经有自己的 TTS HTTP 接口 | 自定义 HTTP 合成 | 适合固定接口、固定请求格式 |
| 接口需要复杂认证、签名或 WebSocket | 自定义动态音源 | 灵活,但需要写脚本 |
| 小说对话很多,希望区分旁白和角色 | 多角色朗读 | 可为旁白、对话配置不同音色 |
朗读引擎列表
打开「语音朗读」,顶部的「朗读引擎」可以切换引擎,下面列出这个引擎里的声音。需要填密钥的引擎,右侧有「配置」按钮。
| 引擎 | 说明 |
|---|---|
| 「系统」 | 设备自带的声音,列表里带「离线」标记 |
| 「微软 Azure」 | 微软语音合成,每月有免费额度 |
| 「阿里云」 | 阿里云语音合成,需在控制台开通 |
| 「AWS Polly」 | 亚马逊语音合成,支持多语言 |
| 「火山引擎」 | 字节跳动语音合成,支持大模型音色 |
| 「小米 MiMo」 | 小米语音合成,支持按量和套餐 |
| 「未分类」 | 没有填分组的自定义声音 |
你自己添加的声音(自定义 HTTP 合成、动态音源、AI 语音)填了分组时,分组名也会出现在引擎列表里。
系统语音
系统语音适合第一次体验听书。
优点:
- 不需要注册第三方服务
- 通常可以离线使用
- 配置最简单
注意:
- 不同设备可用声音不一样
- 声音自然度取决于系统
- 部分设备可能需要在系统设置里安装更多语音包
- 安卓上,系统声音按手机里装的朗读引擎分组,每个朗读引擎单独出现在引擎列表里。装了 MultiTTS 这类第三方朗读引擎后,它也会作为一个引擎出现
- iPhone、iPad 上不能安装第三方朗读引擎,系统语音只有 iOS 自带的声音。嫌系统声音不好听,改用在线语音服务或 AI 语音
用第三方朗读引擎时,引擎 App 自己也要允许后台运行、关闭电池优化,否则锁屏后容易读几句就停,见 听书常见问题。
在线语音服务
在线语音服务通常音质更自然,音色更多,适合长期听书。
常见选择包括:
使用前先确认:
- 是否需要注册账号或实名认证
- 是否有免费额度
- 超出额度后如何计费
- 服务区域、密钥、音色是否已经准备好
更多共同注意事项见 在线语音服务。
AWS Polly
亚马逊的语音合成服务。在「朗读引擎」里选「AWS Polly」,点「配置」,填入「Access Key ID」「Secret Access Key」和「区域」后保存。
小米 MiMo
小米的语音合成服务。在「朗读引擎」里选「小米 MiMo」,点「配置」:
- 「API Key」:支持按量付费的 sk- 开头的 Key,也支持 Token Plan 套餐的 tp- 开头的 Key
- 「风格提示词」:可选,用自然语言描述朗读语气、节奏或情绪
- 点「保存并导入内置音色」,MiMo 的内置声音就会出现在列表里
填好 API Key 后,还可以设计自己的声音:点「语音朗读」右上角的添加按钮,选「MiMo 声音」,填名称和「声音描述」,例如「温柔沉稳的年轻女声,语速偏慢,适合长篇小说旁白」。
AI 语音
如果你已经在 AI 设置里添加了 AI 提供商,可以直接用它的语音合成接口听书,不用再单独配置一套服务。
- 点「语音朗读」右上角的添加按钮,选「AI 语音」
- 选择「AI 提供商」,Reeden 会根据提供商地址自动填好「TTS 接口地址」,需要时可以手动改
- 填写「模型」「声音标识」,按需选择「音频格式」和「语速」
- 保存后在声音列表里试听
AI 语音的费用按你的 AI 提供商计费。还没有添加提供商时,会提示「请先在 AI 设置中添加提供商」。
自定义音源
如果你已经有自己的语音服务,或从其他渠道拿到了 TTS 接口,可以使用自定义音源。
- 自定义 HTTP 合成:适合一个 HTTP 请求就能返回音频的接口
- 自定义动态音源:适合多步骤认证、Token 缓存、签名、WebSocket 或流式合成
如果你不确定接口该怎么接,先从自定义 HTTP 合成开始;只有 HTTP 配置表达不了的场景,再使用动态音源。
朗读高亮和翻页
听书按段落朗读。能不能跟着读到的字实时高亮(也叫逐句高亮、逐字高亮),取决于声音来源:
| 声音来源 | 高亮方式 |
|---|---|
| 微软 Azure、阿里云、火山引擎 | 跟着读到的位置实时高亮 |
| 自定义动态音源 | 音源脚本写了字幕时实时高亮,否则整段高亮 |
| 安卓以外的系统语音(iPhone、iPad、Mac 等) | 引擎回报朗读进度时实时高亮,否则整段高亮 |
| 安卓系统语音(包括 MultiTTS 等第三方朗读引擎) | 整段高亮 |
| AWS Polly、小米 MiMo、AI 语音、自定义 HTTP 合成 | 整段高亮 |
翻页也跟着高亮走:实时高亮的声音读到页尾就翻页;整段高亮的声音要等这一段读完才翻到下一页,一段跨两页时想提前看就手动翻。
不想要实时高亮,在听书页「设置」→「高亮」里打开「整段高亮」。「高亮样式」可以换成「荧光」「波浪线」「背景色」等样式。
开着沉浸式翻译时,听书只读原文。
多角色朗读
多角色朗读适合小说、剧本、访谈等对话较多的内容。它会尝试区分旁白和对话,再用不同声音朗读。
继续看 多角色朗读。
Reeden