
10分钟让第一本电子书开口ebook2audiobook 手把手上手【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook晚上躺在沙发想听那本300页的小说眼睛却比字还干。打开 ebook2audiobook一个把电子书转成有声书的开源工具把文件拖进去睡前听到的就是真人感的声音在替你读书。️ 能力速览丢一本 EPUB 进去出来的就是带章节、能直接播放的 M4B 文件。它支持 1158 种语言从英语中文到一堆小语种都有。录 5 秒自己的声音就能克隆成专属讲述者。2GB 内存、1GB 显存的机器也跑得动。 场景化实操第一次转书EPUB 转成能下载的有声书你只想听书、不想碰任何参数这个场景三步走完终端里执行下面这条命令拿到代码git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook进入 ebook2audiobook 目录Windows 双击 ebook2audiobook.cmdmacOS/Linux 执行 ./ebook2audiobook.command首次运行会自动装好依赖并打开 localhost:7860 页面上传书籍、选好语言和 CPU/GPU 后点 Convert想调音色就切到 Audio Generation Preferences 页动温度与语速滑杆转换完成后按钮下方就是 Listen 播放器Audiobooks 下拉框直接列出生成的 m4b 供下载EPUB 的章节结构会自动识别播放器里可以按章续听。扫描版 PDF 教材转成能听的音频你下载的教材整本都是扫描图片复制粘贴一个字都出不来。照常上传就行E2A 检测到图片页会自动调用 Tesseract OCR一个开源的文本识别引擎逐页识别再走正常合成流程不用你另外做识别唯一要注意的是语言选得和书一致。听完你会得到和原文一致的完整内容标准印刷页基本都能认全手写批注和复杂排版会多些漏网之鱼。无头模式批量转整个文件夹读书清单里排着十几本书你不想一本本打开网页上传。终端里跑 headless 模式整个文件夹一次跑完Windows 用户把开头的脚本名换成 ebook2audiobook.cmd./ebook2audiobook.command --headless --ebooks_dir ./my_books --language eng单本书用 --ebook 传路径想顺便克隆声音就加 --voice 指向一段音频。产物落在 audiobooks 目录文件名跟原书对应跑完直接拿去听。️ 进阶玩法5 秒语音样本怎么传默认音色够用但你想让书听起来像你在讲。输入页右侧的 Cloning Voice 上传区接受 .wav 文件界面标注了要求不超过 6 秒主要语言用 24000Hz、其他语言用 22050Hz走 headless 模式则是加一个 --voice 参数加路径。传完整本书都用你克隆出来的音色讲。SML 标签怎么控制停顿和换声长文本一路匀速念下来没呼吸感多角色对话也分不清谁是谁。E2A 内置了 SML一种简单的标记语言标签[break] 给 0.3–0.6 秒的短停顿[pause] 给 1.0–1.6 秒的长停顿[pause:3] 固定停 3 秒[voice:/path/to/voice.wav]...[/voice] 则能在段落中间切换到另一段声音——相当于给对话小说的每个角色配了不同的播音员。⚡ 选型速查项目最低能跑推荐硬件2GB 内存 1GB 显存8GB 内存 4GB 显存输入格式epub、mobi、pdf、txt 等 20 余种EPUB、MOBI可自动识别章节输出格式mp3、flac、wav、ogg 等m4b带章节标记只有 CPU 的话现代 TTS 引擎偏慢建议选 YourTTS、Tacotron2 这类轻量引擎。现在就可以打开浏览器试一次完整参数说明在 README.md默认输出格式和设备等设置都能在这份配置文件里改。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考