电子书转有声书完整指南:ebook2audiobook 从第一本到整书架【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobookebook2audiobook 是一个电子书转有声书工具:把 epub、mobi、pdf 等 20 多种格式转成带章节标记的有声书,内置 XTTSv2、Bark、VITS 等 8 种 TTS(文本转语音)引擎,覆盖 1158 种语言,最低 2GB 内存、1GB 显存就能跑。 第一次转换:两条命令拿到音频git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook ./ebook2audiobook.commandWindows 用户双击ebook2audiobook.cmd即可。脚本会自动补齐缺失的依赖,然后在浏览器打开 http://localhost:7860 的 Gradio 网页:上传电子书、选语言、点 Convert,转完直接在线试听或下载。整个流程:上传、选参数、试听、下载都在这一个网页里完成选文件时记住两点:章节自动检测对 epub 和 mobi 最稳,其他格式按连续文本处理;默认输出 m4b(有声书容器,保留章节结构),也可换 mp3、flac、wav 等,单声道或立体声都可选。纯扫描版也不用先手动转文字:内置 OCR 能识别 PDF、JPG、PNG、TIFF 这类以图片形式存字的页面。 换个音色:语音克隆与参数调优想用自己的声音,上传一段 1–5 分钟的录音就行,不用提前降噪——工具会自动清理背景噪音。引擎按硬件选:有 GPU:XTTSv2,多语言、克隆质量高;只有 CPU:换 YourTTS、Tacotron2 这类轻量引擎,README 里明确说大模型在 CPU 上很慢。更细的控制靠文本里的 SML 标签:[pause:3] 插入 3 秒停顿,[voice:/path/to/voice.mp3]…[/voice] 在文中切换声音,一本小说可以让不同角色用不同音色;仓库里的 E2A-SML 组件 还能自动给电子书插入这些标签。引擎、温度、语速等合成参数在界面的音频设置区调整XTTS 的温度、语速等参数就在这个区域;想批量改默认值,可以编辑lib/conf.py。 一书架一次转:headless 批量模式./ebook2audiobook.command --headless --ebooks_dir ./my_books --language eng这条命令会把文件夹里所有支持的电子书依次转完,常用搭配:--output_format mp3:换输出格式;--translate fra:先翻成法语再合成,成品带_fra后缀,不会和原文件混;--session:中断后用同一会话恢复,不用从头再来;--voice_map:传一个 JSON,给每本书指定不同声音。️ 卡住了,按这个顺序查GPU 没被识别:确认--device的值(CUDA、MPS、ROCM、XPU),识别不了会自动回落到 CPU;转换太慢:多半是跑在 CPU 上,换轻量引擎或启用 GPU;依赖冲突:别和 Python 环境死磕,项目自带 Docker,开箱即用;音频截断:通常是分句逻辑不适配你的语言,去 issues 区反馈,维护者需要用户报告来修。下一步:挑一本短一点的 epub,在网页界面转成 m4b 听一遍;想在云端免费跑,仓库的 Notebooks 里有现成的 Colab 和 Kaggle 版。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考