Read Aloud 与 PDF 转有声书
把 pdf 转成有声书,或把任何文档变成朗读音频——Read Aloud 生成普通 MP3,Document to Audiobook 生成带章节标记的 M4B,可在任何有声书应用里播放。语音由 Piper 模型在设备上生成,下载一次后完全离线运行。
在 1FileTool 里把 PDF 变成有声书只要点两下:把文档拖到 AI Tools › Document to Audiobook,就能拿到一个在任何有声书应用里都能播放的带章节 M4B;或者选 Read Aloud 生成文档或文本的普通 MP3。语音在设备上生成——声音模型下载一次后就不再需要网络。
先保护好原始文件
Replace source 默认开启:输出会覆盖原文件且不保留备份。在跟着操作之前,请打开 Settings › General 关闭 Replace source,或另选一个输出文件夹。
音频文件作为新文件写入你的输出文件夹;源文档绝不被修改。
两个工具
| 工具 | 输入 | 输出 |
|---|---|---|
| Read Aloud | PDF、Markdown 或纯文本 | MP3 语音——"Turn a document or text into natural speech (MP3)" |
| Document to Audiobook | PDF 或 Markdown | 带章节标记的 M4B,或 MP3——"PDF or Markdown to a chaptered M4B audiobook" |
两个都在 AI Tools 下面。拖入文档、选个声音、运行——音频文件就落在你的输出文件夹。
声音
声音是 Piper 模型,下载一次(每个约 60–120 MB)后完全离线运行:
| 声音 | 口音 | 大小 | 备注 |
|---|---|---|---|
| Lessac | 美式英语 | ~63 MB | 推荐默认 |
| Amy | 美式英语 | ~63 MB | |
| Alan | 英式英语 | ~63 MB | |
| Ryan | 美式英语 | ~121 MB | 质量最高,生成更慢 |
每次运行选一次声音;模型留在磁盘上供下次用。
格式与章节
Document to Audiobook 提供 Output format 选项——应用自己的提示语是:"M4B carries chapters, MP3 plays anywhere."
- M4B 的章节标记取自文档标题——Markdown 的
##节或检测到的 PDF 分节——所以播放器可以在章节间跳转。 - MP3 是一条平坦音轨,用 libmp3lame V3 质量编码,换来最大的播放器兼容性。
Markdown 会先被摊平成可朗读的文本,所以标记字符绝不会被念出来。
限制
- 免费档: 声音试听前 ~600 个字符——够你在升级前听过声音。
- Pro: 全长文档。
- 语音是单向的。没有转写或字幕生成——把音频变成文字不是它的功能。