Ebook2Audiobook 快速指南:3条命令把电子书变成有声书
Ebook2Audiobook 快速指南3条命令把电子书变成有声书【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook通勤路上不想再干瞪着屏幕Ebook2Audiobook 把电子书转有声书本地一键生成带章节的 m4b/mp3 音频还能用你自己的声音朗读。能力速览电子书转有声书自动分章输出支持 epub、mobi、azw3、pdf、txt 等格式️ 覆盖 1158 种语言语音克隆1 到 5 分钟录音即可内置 XTTSv2、Bark、VITS 等 8 种 TTS 引擎无图 PDF 自动 OCR 识别成文字3条命令跑通从克隆到第一段音频最低配置 2GB 内存、1GB 显存CPU 也能跑建议换轻量引擎。克隆仓库git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook首次启动 GUI 模式Linux/Mac 与 Windows 二选一。脚本会自动装好 Python 环境和依赖浏览器打开http://localhost:7860/即进入转换界面./ebook2audiobook.command # Windows 用ebook2audiobook.cmd之后每次运行都是这一步上传文件、点按钮就能听到第一段音频嫌麻烦的话也可以跳过界面看下面「界面走读」。界面走读从上传到试听主界面只有一个 Dashboard 标签页点几下就能开始转换Import 区域上传电子书epub、mobi 章节识别最准。Language 选语言Voices 试听内置音色也可以上传一段自己的录音。点 开始转换切到 XTTS Settings 标签页只盯一个参数Temperature 建议 0.65 左右太低机械、太高跑偏。完成后在 Audiobook 区域在线试听点 ↧ 下载最终文件。成品默认 m4b统一放在audiobooks/目录下。它底层怎么干活章节怎么切、引擎怎么选章节怎么切epub、mobi 这类格式本身就带章节结构工具直接按结构拆段txt、pdf 没有结构就靠文本特征自动切块纯图片的 PDF 先走 OCR光学字符识别把图片里的字认成文字再切。每块文本逐句送给 TTS 引擎合成音频中间自动插入停顿最后拼成一整本书并写入章节标记和元数据播放器里能按章跳转。引擎怎么选内置 XTTSv2、Bark、VITS、Fairseq、Tacotron2 等 8 种 TTS 引擎把文字读成语音的模型界面按语言自动推荐默认引擎。其中 XTTSv2 带零样本语音克隆给一段录音就能模仿那个音色不用专门训练想要更贴近真人就选它纯 CPU 机器建议换 YourTTS、Tacotron2 这类轻量引擎速度快很多只是音色偏 Siri 味。想再玩深一点如果你有用自己的声音读整本书的需求录一段 1 到 5 分钟的清晰录音上传即可有背景噪声也没关系工具会自动降噪。命令行模式下加一个参数./ebook2audiobook.command --headless --ebook 书.epub --language eng --voice 你的录音.mp3如果要音色更贴仓库里自带 Universal_TTS_Finetune 微调工具在 Google Colab 或 Kaggle 上跑 kaggle-xtts-finetune-webui-gradio-gui.ipynb 训练自己的 XTTSv2 模型把模型打成 zip 后用--custom_model指向它即可。批量转一整柜书把--ebook换成--ebooks_dir指向目录就行。踩坑速查GPU 识别不到 → 先nvidia-smi确认驱动不行就加--device CPU回退转换中途被打断 → 加--session恢复上次会话不用从头再来EPUB 转出来混着前言、版权页 → epub 没有标准章节结构转换前先手动删掉不想要的文字它替你省掉的是找真人朗读或自己啃的那部分。现在就去终端跑第一条命令装完打开浏览器第一个章节马上出声。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联
返回资讯列表 →