电子书变有声书只要 3 步ebook2audiobook 免费转换工具完整教程【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook手头有一堆没音频版的电子书通勤路上、做家务时想听书却只能干瞪着屏幕ebook2audiobook下文简称 E2A就是为这个痛点而生的开源工具它能把你本地的电子书直接转换成带章节和元数据的有声书支持超过 1158 种语言还能用你自己的声音来朗读这就是语音克隆录一段你的声音AI 模仿它来念书。整个过程完全免费在 Windows、macOS、Linux 上都能跑。为什么这个工具值得你花 5 分钟了解先说结论市面上能一键电子书转有声书、还带章节结构的开源项目不多E2A 是目前功能最全的一个。它的几个硬实力格式通吃.epub、.mobi、.azw3、.pdf、.txt、.docx、.fb2等二十来种格式都能转PDF 和扫描图片还支持 OCR光学字符识别把图片里的文字识别出来。语音引擎可换内置 XTTSv2、Bark、Fairseq、VITS、Tacotron2 等多套 TTSText-to-Speech文本转语音引擎不同引擎在音质和速度上各有所长你可以按硬件条件挑。语音克隆上传一段 1~5 分钟的语音样本转换出来的有声书就用你的声音朗读背景带噪声也没关系工具会自动帮你做降噪。低配也能跑最低 2GB 内存 / 1GB 显卡显存即可运行没有独显的纯 CPU 电脑也可以选轻量引擎如 YourTTS、Tacotron2转换。多语言中文zh/chn、英语en、西语es、日语ja、韩语ko等 1158 种语言全覆盖中文切句做了专门优化不会把词语从中间劈开。输出即成品产物是标准m4b、mp3、flac、wav等格式自带章节和元数据直接丢进 Apple Books、Audiobookshelf 等播放器就能按章听。小提示请只转换你合法拥有、无 DRM 保护的电子书遵守当地法律法规。上手流程从 0 到第一本有声书只需 3 步第一步拿到项目代码保存好下面这段命令按系统选择git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook第二步一条命令安装并启动启动脚本会自动装好 Python 虚拟环境和所有依赖macOS 会自动装 HomebrewWindows 会自动装 Scoop无需你操心Linux / macOS./ebook2audiobook.commandWindows命令行或双击ebook2audiobook.cmdebook2audiobook.cmd第三步打开浏览器就能用脚本跑起来后终端会打印一个网址默认是http://localhost:7860/点进去就是 E2A 的 Web 界面。首次运行要下载 TTS 模型稍等片刻即可。如果转换中途脚本被停掉又重新运行记得刷新浏览器页面让它重新连接。实战演示GUI 和命令行两种用法GUI 模式拖拽转换新手首选打开 Web 界面后操作流程就是三选一把电子书文件拖进EBook File上传区在Language下拉框选语言中文选 Chinese英语默认 English选 CPU 或 GPU 作为处理单元点Convert开转。右侧的Cloning Voice克隆语音和XTTS Model自定义模型都是可选项新手第一次先留空即可。转换完成后页面下方会出现播放器可以在线试听还能直接下载生成的有声书。在第二个标签页Audio Generation Preferences你还可以调节 Temperature创造性、Speed语速、Repetition Penalty防重复等生成参数让朗读风格更像真人命令行模式headless 无界面直接转想要丢个文件进去就自动出结果或者批量跑任务就用无界面模式。Linux / macOS./ebook2audiobook.command --headless --ebook 电子书路径 --language 语言代码Windowsebook2audiobook.cmd --headless --ebook 电子书路径 --language 语言代码参数说明--ebook要转换的电子书文件路径--language语言代码支持 ISO-639-1如zh、en或 ISO-639-3如chn、eng、deu不写默认英语--voice可选语音克隆的音频文件路径带上就用你的声音朗读。所有参数一览可以看app.py --help还支持--ebooks_dir整个文件夹批量转换、--output_format mp3指定输出格式等。进阶玩法用你自己的声音朗读录制一段 1~5 分钟的干净语音wav/mp3 等常见音频格式都行转换时通过 GUI 上传或加--voice 你的语音文件即可。录制环境嘈杂也没关系E2A 内置降噪会把背景音清掉。注意 XTTSv2 引擎下语音样本时长建议不超过 6 秒效果最佳长样本也支持按需选择。SML 标签精细控制停顿和换声E2A 支持一套叫 SML 的轻量标记标签写在文本里就能控制朗读节奏[break]短停顿0.3~0.6 秒[pause]长停顿1.0~1.6 秒[pause:3]固定停顿 3 秒[voice:/path/to/voice.wav]...[/voice]某段文字切换成另一个声音这对小说里区分多个说话人特别有用。项目里还附带了 components/E2A-SML 组件可以自动给小说加对话归属和 SML 标签想看实际效果可参考 tools/workflow-testing/sml-test.txt。上传自训练的自定义模型如果你自己微调过 TTS 模型把它打成 zip需包含 config.json、model.pth、vocab.json、ref.wav 等必需文件转换时加--custom_model 模型zip路径即可使用。模型文件要求定义在 lib/conf_models.py 中。想系统学习微调可以玩一下 components/Universal_TTS_Finetune它把 Coqui 全家桶XTTS、VITS、Tacotron、Piper 等的训练流程打包成了一条命令。本地配置项想改哪改哪默认设备、输出目录、默认输出格式m4b、默认语言等都在 lib/conf.py 里所有支持的语言代码和映射关系在 lib/conf_lang.py。想长期改动建议先备份原文件方便升级时恢复。手头没机器直接用云端 Notebook仓库的 Notebooks/ 目录提供了现成的 Google Colab 和 Kaggle 笔记本如 Notebooks/colab_ebook2audiobook.ipynb导入后在免费 GPU 上运行不用占用自己的电脑。Google Colab 重启运行时操作示意图如果 Colab 运行中断了按上图从 Runtime 菜单选 Restart session 即可恢复。避坑指南新手最容易踩的几个坑EPUB 没有标准章节结构EPUB 格式本身不区分章节、序言、脚注转之前建议手动删掉你不想被读出来的内容如目录页、版权页否则这些也会被念出来。章节识别效果最好用.epub或.mobi这两种格式自带章节元数据自动分章最准纯.txt则按文本结构推断。纯 CPU 会很慢现代 TTS 引擎在 CPU 上接近听书等书建议 CPU 环境选 YourTTS、Tacotron2 这类轻量引擎有 GPUCUDA/ROCm/MPS/XPU时速度可接近实时。依赖冲突别硬修如果本地安装依赖老是报错直接用官方 Docker 镜像最省事它完全自包含且支持 headless 模式仓库根目录就有 Dockerfile 和 docker-compose.yml。GPU 没被识别先用仓库里的 detect_gpus.py 检测一下设备再对照--device参数手动指定CPU/CUDA/MPS/ROCM/XPU/JETSON。音频有截断/断句奇怪这通常是特定语言的句子切分逻辑需要调优去项目 Issues 区反馈并尽量附上截断处的原文。只想试试水ebooks/tests 目录里备好了几十种语言的test_*.txt和 azw3 测试小书拿来练手最合适比如先转一本test_zho.azw3体验中文效果。最后工具本身很轻克隆、一条命令启动、拖入电子书点转换10 分钟后你的第一本有声书就躺在下载列表里了。剩下的事交给你的耳朵去验证。快去试试吧把书架里吃灰的电子书变成通勤路上的播客。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考