>_ DevTrendszh

语言

首页

语言

板块

前端 后端 移动端 DevOps AI / ML 游戏开发 区块链 嵌入式 安全
Python

ebook2audiobook — 您的个人AI有声书工厂

您上一次没有足够时间阅读心爱的书是什么时候?或者您是否想在慢跑时听技术文档?ebook2audiobook项目让这些梦想成为现实——支持1100+语言和语音克隆功能。

这是什么工具?

ebook2audiobook是一个开源Python解决方案,使用现代文本转语音(TTS)模型从电子格式创建有声书。它在后台运行强大的引擎,包括:

  • XTTSv2
  • Bark
  • VITS
  • Fairseq
  • YourTTS
  • Tacotron

Interface demo

核心功能

  1. 支持1100+语言 — 从英语到稀有方言
  2. 语音克隆 — 可以使用您自己的声音进行朗读
  3. 自动章节分割 — 保留书籍结构
  4. 多种输出格式 — MP3、M4B、FLAC等
  5. 即使在低端硬件上也能运行 — 最低要求4GB内存

实际使用效果如何?

安装很简单——支持所有操作系统:

git clone https://github.com/DrewThomasson/ebook2audiobook.git
cd ebook2audiobook
./ebook2audiobook.sh  # Для Linux/Mac

或者更简单的方式——通过Docker:

docker run --pull always --rm -p 7860:7860 athomasson2/ebook2audiobook

启动后,您打开Web界面上传EPUB、PDF或其他支持的格式的书籍,选择设置——稍等片刻即可获得一个现成的有声书。

谁会特别需要它?

  • 开发者 — 用来听文档
  • 学生 — 随时随地学习材料
  • 作家 — 从外部聆听自己的文字
  • 视力障碍人士 — 以音频格式获取书籍
  • 多语言学习者 — 支持大量语言

技术特点

该项目正在积极开发中——已经具备:

  • GPU支持,处理速度更快
  • 语音参数微调
  • 与Google Colab和Kaggle集成
  • Docker Compose支持

ebook2audiobook是最先进的开源文本转语音工具之一。如果您一直想创建自己的音频库,或者在寻找一种在旅途中"阅读"书籍的方式——绝对值得一试。

该项目正在积极开发中,已在GitHub上获得超过1万颗星。加入Discord社区,立即开始创建您的有声书!

相关项目