一条命令把电子书变成有声书:ebook2audiobook 实操教程 一条命令把电子书变成有声书ebook2audiobook 实操教程【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook通勤地铁上你想把一本没读完的 EPUB 直接听掉。ebook2audiobook 可以把 EPUB、PDF、MOBI 等 20 多种电子书格式转成带章节标记的有声书支持 1158 种语言和语音克隆全程本地离线运行数据不出你的电脑。 它到底能做什么支持 23 种输入格式.epub、.mobi、.azw3、.pdf、.txt、.docx、.html、.rtf、.odt、.zip等图片类扫描件可走内置 OCR 先转文字。内置 8 种 TTS 引擎XTTSv2、Bark、VITS、Tacotron2、Tortoise、GlowTTS、YourTTS、Fairseq可按硬件水平挑选。覆盖 1158 种语言中文、英文、日文等都有对应语言代码。语音克隆只需一段 1~5 分钟的参考音频录音带背景噪音也能用工具会自动降噪。输出 10 种音频格式.m4b、.mp3、.wav、.flac、.ogg、.m4a、.aac等.m4b默认保留章节结构。⏱️ 五分钟跑起来快速安装步骤硬件门槛不高内存 2GB 起步、推荐 8GB有显卡建议显存 4GB 以上脚本会自动装好 Python 3.10~3.12 环境不用你手动配。克隆代码到本地git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook启动程序Windows 双击ebook2audiobook.cmdLinux/macOS 运行./ebook2audiobook.sh首次运行会花几分钟下载依赖。打开浏览器访问终端里打印的地址http://localhost:7860/图形界面就出来了。第一次转换想跳过界面一行命令就能完成第一次电子书转语音音频默认输出到audiobooks目录、格式为.m4b./ebook2audiobook.sh --headless --ebook 你的书.epub --language eng️ 图形界面三步出片把书拖进上传区打开 Input Options 页面把电子书文件拖入 Drop File Here 区域也可以直接点击选择文件。⚠️ 提示工具只支持无 DRM 的书籍EPUB 没有统一的章节标准转换前先把序言、目录等不想听的内容删掉。切换标签页调参数进入 Audio Generation Preferences 标签选择 TTS 引擎和参考音频按需调整语速、温度等参数不确定就全部保持默认。点击 Convert 并下载点击 Convert 后按章节逐段合成进度条走完即可在结果区试听然后下载整个音频文件。中途想取消点上传组件的 [X] 即可。️ 进阶玩法语音克隆配置方法准备一段 1~5 分钟的人声录音.wav/.mp3均可转换时通过--voice参数传入路径或用图形界面的音频上传口。噪音不用手动清理e2a 会在合成前自动降噪。语音克隆读书很适合给孩子做爸爸妈妈念书版的定制故事音频。批量转换命令有一整个文件夹的书要处理时把--ebook换成--ebooks_dir加--output_dir指定输出位置./ebook2audiobook.sh --headless --ebooks_dir ./books --language eng参数调优温度--temperature控制朗读的稳定性与变化感从 0.6~0.8 开始试语速--speed最高可调到 3 倍--top_p和--top_k调小后生成更快、输出更稳适合长书。⚙️ 参数怎么选引擎怎么选直接看这张表维度XTTSv2YourTTSBark语音克隆支持1~5 分钟样本即可不支持用固定音色支持速度GPU 上接近实时CPU 上很慢CPU 上最快最慢适合短内容音质最接近真人中等偏 Siri 风格自然、情感表达丰富推荐场景AI有声书制作的主力选择低配电脑快速听书需要表现力的章节朗读输出格式上.m4b带章节标记适合长篇.mp3兼容性最好.wav无损适合后期剪辑。遇到问题先查这里Q重启脚本后网页打不开了浏览器页面不会自动重连手动刷新一下页面即可重新接入。Q转换特别慢XTTSv2 这类现代引擎在纯 CPU 上非常慢。要么换 YourTTS、Tacotron2 这类 CPU 友好的引擎要么加--device CUDA或 MPS启用显卡。Q章节切分不干净.epub和.mobi的自动章节识别最好如果你的 EPUB 里夹带了说明文字转换前先删掉它们。Q克隆用的录音很吵不用重录工具会自动去噪只需保证录音时长在 1~5 分钟之间。挑一本你最近在读的书照上面的步骤转一遍听到第一句合成语音就算跑通了。更多参数说明见 README.md默认输出配置在 lib/conf.py。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考