一键把 EPUB 变成带章节的有声书:ebook2audiobook 实战指南
2026/9/7 7:13:48 网站建设 项目流程

一键把 EPUB 变成带章节的有声书:ebook2audiobook 实战指南

【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning & 1158+ languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook

把 EPUB 或 MOBI 扔进去,拿回一个带章节、带元数据的 M4B——这就是 ebook2audiobook 干的事:一个支持 1158 种语言、能用自己声音朗读的电子书转有声书工具,适合想听书又不想折腾 TTS 模型的人。

把 EPUB 变成带章节的 M4B:它都能干什么

能力适合谁
Web 界面逐本转换,默认输出带章节标记的 M4B个人用户、第一次尝试 TTS 的人
--headless命令行转单本,或整个目录批量转服务器、自动化流程
语音克隆:传一段录音,用自己的声音朗读配音爱好者、自作者
1158 种语言,ISO-639-3 三字母码和两字母码都认多语种读者
对扫描版 PDF、图片文件做 OCR 识别再转只有扫描书的人

只要其中一行戳中你的需求,往下看;否则关掉这页省时间。

动手前,把这份环境清单过一遍

  • 内存 2GB 起步、8GB 推荐;有独显的话显存 1GB 起步、4GB 推荐
  • 系统不限:Windows、Linux、macOS 都能跑,Intel/AMD/ARM 均可
  • Python 要求 3.10–3.12,官方脚本会用 conda 自动装好环境,不用手动装
  • 磁盘留足空间:TTS 模型会下到models/里,有好几个 GB
  • 书必须是无 DRM、合法获取的文件

安装与启动:本地一键和 Docker 怎么选 ⚡

推荐本地一键。脚本自己会把 calibre、ffmpeg 等依赖和 Python 环境装好,你要做的就是等:

git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook && ./ebook2audiobook.sh

Windows 直接双击ebook2audiobook.cmd即可。备选 Docker 路线:先ebook2audiobook.cmd --script_mode build_docker构建镜像,再docker compose --profile cpu up,依赖全部隔离在容器里。

启动成功的标志只有一个:终端出现http://localhost:7860,浏览器打开就是操作界面。注意:脚本重启后,页面要手动刷新一下才能重连。

第一次转换:把文件放进 ebooks/,结果在 audiobooks/ 拿

三个目录各管一摊:ebooks/放待转换的书,voices/放语音样本,audiobooks/放结果(界面转换的输出具体在audiobooks/gui/gradio/)。

  1. 把一本 EPUB 或 MOBI 放进ebooks/——这两种格式自动识别章节的效果最好
  2. 界面里选语言(默认英文 eng)和 TTS 引擎,声音用预设或先跳过
  3. 点转换,等它跑完,audiobooks/里会出现以书名命名的 M4B

一个坑提前说:EPUB 没有标准章节结构,版权页、目录这类不想被读出来的文字要先手动删掉,否则会照念不误。

进阶玩法:语音克隆、多语言码与无头批量

语音克隆:用自己的声音朗读

在界面语音栏上传一段清晰录音,README 建议理想时长 1–5 分钟,带背景噪音也没关系,工具会自动降噪。命令行里对应--voice参数。

语言码:三字母或两字母都行

--language接受 ISO-639-3 三字母码或两字母码:英语eng、中文zho、日语jpn、法语fraen/ja/fr也认。完整语言列表见 lib/conf_lang.py。

命令行:不开界面批量转

./ebook2audiobook.sh --headless --ebook 路径/book.epub \ --language eng --voice 路径/voice.wav

--ebook指定单本,换--ebooks_dir就是整目录批转;--output_format可改成 mp3、wav 等,默认 m4b 的设置在 lib/conf.py。

避坑速查:现象 → 怎么办

现象处理办法
启动失败、依赖报错核对 Python 版本在 3.10–3.12,或直接换 Docker,环境是自包含的
转换太慢挂 GPU 跑;纯 CPU 就换 YourTTS、Tacotron2 这类轻量引擎
语音不自然调低 temperature 参数,或换引擎、换预设音色
GPU 没被识别检查驱动与 CUDA 版本是否匹配,脚本会自动探测 CUDA/ROCm/XPU/MPS
某段音频被截断到项目 issues 区反馈,维护者需要你的语言样本来修分句逻辑

建议的下一步就一件事:挑一本几十页的短 EPUB,按上面的流程把第一次转换跑通,确认 M4B 带章节、元数据完整之后,再上长篇,顺便试一次语音克隆。

【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning & 1158+ languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询