一键把 EPUB 变成带章节的有声书:ebook2audiobook 实战指南
【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning & 1158+ languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook
把 EPUB 或 MOBI 扔进去,拿回一个带章节、带元数据的 M4B——这就是 ebook2audiobook 干的事:一个支持 1158 种语言、能用自己声音朗读的电子书转有声书工具,适合想听书又不想折腾 TTS 模型的人。
把 EPUB 变成带章节的 M4B:它都能干什么
| 能力 | 适合谁 |
|---|---|
| Web 界面逐本转换,默认输出带章节标记的 M4B | 个人用户、第一次尝试 TTS 的人 |
--headless命令行转单本,或整个目录批量转 | 服务器、自动化流程 |
| 语音克隆:传一段录音,用自己的声音朗读 | 配音爱好者、自作者 |
| 1158 种语言,ISO-639-3 三字母码和两字母码都认 | 多语种读者 |
| 对扫描版 PDF、图片文件做 OCR 识别再转 | 只有扫描书的人 |
只要其中一行戳中你的需求,往下看;否则关掉这页省时间。
动手前,把这份环境清单过一遍
- 内存 2GB 起步、8GB 推荐;有独显的话显存 1GB 起步、4GB 推荐
- 系统不限:Windows、Linux、macOS 都能跑,Intel/AMD/ARM 均可
- Python 要求 3.10–3.12,官方脚本会用 conda 自动装好环境,不用手动装
- 磁盘留足空间:TTS 模型会下到
models/里,有好几个 GB - 书必须是无 DRM、合法获取的文件
安装与启动:本地一键和 Docker 怎么选 ⚡
推荐本地一键。脚本自己会把 calibre、ffmpeg 等依赖和 Python 环境装好,你要做的就是等:
git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook && ./ebook2audiobook.shWindows 直接双击ebook2audiobook.cmd即可。备选 Docker 路线:先ebook2audiobook.cmd --script_mode build_docker构建镜像,再docker compose --profile cpu up,依赖全部隔离在容器里。
启动成功的标志只有一个:终端出现http://localhost:7860,浏览器打开就是操作界面。注意:脚本重启后,页面要手动刷新一下才能重连。
第一次转换:把文件放进 ebooks/,结果在 audiobooks/ 拿
三个目录各管一摊:ebooks/放待转换的书,voices/放语音样本,audiobooks/放结果(界面转换的输出具体在audiobooks/gui/gradio/)。
- 把一本 EPUB 或 MOBI 放进
ebooks/——这两种格式自动识别章节的效果最好 - 界面里选语言(默认英文 eng)和 TTS 引擎,声音用预设或先跳过
- 点转换,等它跑完,
audiobooks/里会出现以书名命名的 M4B
一个坑提前说:EPUB 没有标准章节结构,版权页、目录这类不想被读出来的文字要先手动删掉,否则会照念不误。
进阶玩法:语音克隆、多语言码与无头批量
语音克隆:用自己的声音朗读
在界面语音栏上传一段清晰录音,README 建议理想时长 1–5 分钟,带背景噪音也没关系,工具会自动降噪。命令行里对应--voice参数。
语言码:三字母或两字母都行
--language接受 ISO-639-3 三字母码或两字母码:英语eng、中文zho、日语jpn、法语fra,en/ja/fr也认。完整语言列表见 lib/conf_lang.py。
命令行:不开界面批量转
./ebook2audiobook.sh --headless --ebook 路径/book.epub \ --language eng --voice 路径/voice.wav--ebook指定单本,换--ebooks_dir就是整目录批转;--output_format可改成 mp3、wav 等,默认 m4b 的设置在 lib/conf.py。
避坑速查:现象 → 怎么办
| 现象 | 处理办法 |
|---|---|
| 启动失败、依赖报错 | 核对 Python 版本在 3.10–3.12,或直接换 Docker,环境是自包含的 |
| 转换太慢 | 挂 GPU 跑;纯 CPU 就换 YourTTS、Tacotron2 这类轻量引擎 |
| 语音不自然 | 调低 temperature 参数,或换引擎、换预设音色 |
| GPU 没被识别 | 检查驱动与 CUDA 版本是否匹配,脚本会自动探测 CUDA/ROCm/XPU/MPS |
| 某段音频被截断 | 到项目 issues 区反馈,维护者需要你的语言样本来修分句逻辑 |
建议的下一步就一件事:挑一本几十页的短 EPUB,按上面的流程把第一次转换跑通,确认 M4B 带章节、元数据完整之后,再上长篇,顺便试一次语音克隆。
【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning & 1158+ languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考