尧图精选

ebook2audiobook实操手册:3步把电子书转成可克隆人声的有声书

🕒 发布时间:2026/9/7 15:55:13 📁 来源:尧图网络
ebook2audiobook实操手册3步把电子书转成可克隆人声的有声书【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook时间紧、书又厚的时候听比读更快。ebook2audiobook简称 E2A是一款开源的“电子书转有声书”工具它用 TTS文字转语音按你指定的音色把全书读出来输出带章节和元数据的有声书文件支持语音克隆与 1158 种语言最低 2GB 内存即可运行。它对普通用户比较友好一行脚本自动搭好 Python 环境随后在浏览器里上传文件、点击转换即可全程不需要碰命令行批量处理时除外。这个工具能做什么输入端兼容 20 多种格式常见的 epub、mobi、pdf、txt、docx、html 都支持其中 epub 和 mobi 的章节结构识别最准确转换后会自动切分出章节。语音合成内置 9 种引擎XTTSv2支持多语言、可零样本克隆人声的 TTS 模型、Bark能带出语气与情绪变化的生成式模型以及 VITS、YourTTS、Piper 等只有 CPU 时建议选 YourTTS、Tacotron2 这类轻量引擎速度更快。输出可选 m4b、mp3、flac、wav 等 10 种音频格式m4b 支持章节标记适合整本播放。扫描版 PDF、图片电子书也内置了 OCR 文字识别可直接转读。三步启动并完成第一次转换先克隆代码并启动Linux/macOSWindows 用户直接双击目录里的ebook2audiobook.cmd即可git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook ./ebook2audiobook.command脚本会自动安装依赖运行结束后在浏览器打开终端打印的地址默认 http://localhost:7860/。界面分两个标签页在“输入选项”中上传电子书、选择目标语言默认英语、勾选 CPU 或 GPU还可以选传一段干净的语音样本——系统会克隆该音色README 建议录音时长约 1–5 分钟带背景噪音也没关系会自动降噪。输入选项页上传电子书与语音样本选择处理器、语言与 TTS 模型点击 Convert 等待进度走完结果页自带播放器可直接试听下方列出生成的文件按 m4b、mp3、flac 等格式下载。转换完成后在线试听、有声书文件列表与下载入口声音与节奏先调这几个参数第二个标签页“音频生成偏好”暴露了默认 XTTS 引擎的合成参数音频生成偏好页温度、重复惩罚、采样、语速等滑杆设置Temperature范围 0.1–10控制语气的“创造性”。平稳朗读用默认 0.65 即可对话多的书可以调高音色变化更自然。Repetition Penalty防止模型反复念同一短语界面默认 2.5长文本建议保留。Top-k / Top-p采样控制数值越小输出越保守、生成越快。Speed0.5 倍到 3 倍语速1 为原速。Length Penalty越高输出越短一般不动。Enable Text Splitting把超长文本切句分段合成降低长文中断风险官方提示该选项效率不高按需开启。这些参数的默认值可在 lib/conf.py 中修改支持的引擎与模型清单见 lib/conf_models.py。批量转换与精细人声控制书多的时候用命令行无界面模式加--headless跳过网页--ebooks_dir指向一个文件夹即可整批转换--voice_map接一个 JSON 文件可为每本书分配不同声音适合给对话类作品分派男女声。想要更细的停顿与换声控制可以在文本里写 SML 标签[break]表示 0.3–0.6 秒短停顿[pause]表示 1.0–1.6 秒停顿[pause:3]固定停 3 秒[voice:/路径/声音.wav]...[/voice]能在书中段切换到另一位讲述者。components/E2A-SML 子项目则可以把这类标签自动插进电子书。扫描件走 OCR 后再合成识别效果大致如下内置 OCR 可识别扫描页与图片电子书中的文字硬件与部署方式项目最低要求推荐配置内存2GB8GB显存1GB4GBCPU 也能跑只是现代 TTS 引擎在 CPU 上明显偏慢选轻量引擎更实际有 GPU 时CUDA另支持 ROCm、Apple Silicon MPS、XPU、Jetson接近实时速度。Windows、macOS、Linux含 ARM均已适配想用干净环境可走 DockerDEVICE_TAGcu128 docker compose --profile gpu up如果你的第一个目标只是让一本书“开口”按上面启动、上传、转换三步就能拿到成品。完整参数列表和常见问题见 README.md没有 GPU 的话Notebooks/ 里的示例笔记本可以在 Colab、Kaggle 等云端环境直接跑。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联 返回资讯列表 →