
电子书转有声书三步搞定ebook2audiobook 免费生成工具完整教程【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobookebook2audiobook简称 E2A是一款免费开源的电子书转有声书工具把 EPUB、MOBI 等格式的电子书丢进去它用 AI 语音引擎把全文朗读并合成音频输出带章节标记和封面元数据的 M4B/MP3 有声书支持语音克隆覆盖 1158 种语言适合想把手里只能看的书变成随时能听的个人用户。一本书进去有声书出来核心能力一览它做的事情可以概括成一条流水线解析电子书文本 → 自动识别章节边界 → 交给 TTS 引擎合成语音 → 拼装成带元数据的成品音频文件。输入格式广.epub、.mobi、.azw3、.txt、.pdf、.html等都能吃自动章节检测以 EPUB 和 MOBI 效果最好多引擎可选内置 XTTSv2、Bark、VITS、Tacotron2、YourTTS 等多种 TTS 引擎按语言自动匹配整书级输出章节结构会保留到成品里书名、作者、封面等元数据一并带入附加能力纯文本直接转音频、对扫描版 PDF 做 OCR、SML 标签控制停顿和换声动手前先核对内存、显卡与 Python 版本硬件门槛不高普通笔记本也能跑项目最低建议内存2 GB8 GB显存1 GB4 GB处理器CPU / XPUIntel、AMD、ARM 均可—系统Windows、Linux、macOS—Python3.103.12 以内设备和速度的关系很直接有 GPU 的设备接近实时转换几页书几秒就出纯 CPU 设备则明显偏慢官方建议改用 YourTTS、Tacotron2 这类轻量引擎牺牲一点音质换回速度。两条安装路线本地脚本与 Docker 怎么挑路线 A本地一键运行想快速上手选它git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook pip install -r requirements.txt然后按系统启动图形界面./ebook2audiobook.command # Linux / macOS ebook2audiobook.cmd # Windows终端会打印一个本地地址通常是http://localhost:7860用浏览器打开即可。路线 BDocker 容器依赖总打架、想环境干净选它docker-compose up -d镜像自包含全部依赖Windows 下需要开启虚拟化容器同样支持无界面的 headless 模式。网页界面使用流程上传、选语言、点转换打开界面后是双标签页结构Input Options拖入电子书文件选择 CPU 或 GPU 作为算力单元在语言下拉框里选定语种需要时上传克隆声音文件Audio Generation Preferences用滑块调整 Temperature越高越有创意但也越容易跑偏、Repetition Penalty抑制复读、Speed语速等参数点击转换进度条实时更新完成后到输出目录拿成品语言配置方法1158 种语言的代码怎么写语言参数接受两种写法ISO-639-3 三字母码或两位短码都可以英语eng或en中文zho或zh日语jpn或ja法语fra或fr不指定时默认使用eng。完整可选项可以在 语言代码列表 lib/lang.py 里查。冷门语言没有对应引擎时还能用--translate参数先把书翻译成有引擎支持的语言再合成。语音克隆配置用自己的声音读这本书 ️准备一段干净的人声样本官方 README 给出的理想时长是 1–5 分钟短至 10–30 秒的录音也能驱动零样本克隆录音带轻微背景噪音也行E2A 会先做清理在界面右栏Cloning Voice处上传音频或命令行传--voice参数选择兼容该语言的 TTS 引擎零样本克隆一般选 XTTSv2开始转换注意参考音频采样率主要语言用 24000 Hz 的 WAV其他语言用 22050 Hz。M4B 还是 MP3输出格式怎么选支持m4b、m4a、mp3、wav、flac、ogg、aac等格式单声道或立体声均可M4B默认首选专为有声书设计播放器能识别内置章节点直接跳转到任意一章MP3兼容性最泛老式播放器、车载音响都能放但没有章节结构WAV / FLAC无损留档用体积大日常听书没必要命令行批量模式不打开界面直接跑脚本本身支持 headless 模式适合整本转换、批量处理或放进定时任务./ebook2audiobook.command --headless --ebook /path/to/book.epub --language eng --voice /path/to/voice.wavWindows 下换成ebook2audiobook.cmd。常用参数--ebook电子书路径--ebooks_dir整个目录批量转换与--ebook二选一--language语言码缺省为eng--voice语音克隆音频路径可选--output_format覆盖默认输出格式敲--help可查看全部参数包括设备选择--device、引擎选择--tts_engine和输出目录--output_dir。项目目录结构速览文件都放在哪ebooks/待转换的电子书放这里也支持任意路径直接指定audiobooks/成品有声书输出目录分cli/和gui/两个子目录voices/语音样本与克隆声音文件lib/核心逻辑默认设备、输出格式等在 lib/conf.py 中配置出问题先查这 5 条常见故障排查GPU 检测不到优先检查显卡驱动和 CUDA/ROCm/MPS 运行时图省事直接改用 Docker镜像里环境是现成的CPU 转换太慢把引擎换成 YourTTS 或 Tacotron2CPU 上差距能拉开数倍依赖装不上、版本冲突别和 pip 纠缠了Docker 镜像自包含一切依赖且原生支持 headless音频被截断、某段没读出来句法切分逻辑按语言持续改进中遇到时提一个 issue 附上样本能帮团队定位声音机械、反复复读到参数页把 Temperature 调低、Repetition Penalty 调高或换一种克隆样本重录写在最后有显卡就开 GPU 跑长书没显卡就选轻量引擎听个乐呵——两种方式都免费、都开箱即用下一步可以试试用自己的声音克隆一版专属朗读。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考