ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

零基础把电子书变成有声书:ebook2audiobook 本地部署上手指南

零基础把电子书变成有声书:ebook2audiobook 本地部署上手指南 零基础把电子书变成有声书ebook2audiobook 本地部署上手指南【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook早高峰地铁上刷完最后半章、睡前想听自己讲的故事——这种需求ebook2audiobook 可以免费满足它是一个在本地电脑上跑的电子书转有声书工具把 EPUB、MOBI 甚至扫描件 PDF 转成带章节的音频还支持用你自己的一段录音克隆嗓音。全程数据不出本机也不用注册任何账号。ebook2audiobook 安装配置全流程从克隆到打开网页拿到代码只要一条命令git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook项目里自带一键启动脚本它会自动建好 Python 虚拟环境、装齐依赖你不用手动敲任何 pip 命令。Linux / Mac运行./ebook2audiobook.commandWindows双击ebook2audiobook.cmd或终端里运行同名命令终端提示成功后浏览器访问http://localhost:7860/就是操作界面。 首次启动会下载 TTS 模型文件耗时几分钟属正常现象之后模型缓存在本地启动会很快。ebook2audiobook 核心功能拆解四个真正用到的功能图1ebook2audiobook 电子书转有声书主界面电子书文件上传、克隆语音与自定义模型入口文件转换引擎。拖入电子书即可开始转支持 epub、mobi、azw3、pdf、txt、docx、fb2 等二十来种格式其中 EPUB 和 MOBI 的自动分章效果最好输出音频会按章节切开。PDF 如果是纯图片扫描件还能走 OCR 识别文字。注意工具只处理无 DRM、合法获取的电子书受保护的书籍会被拒绝。语音克隆。想用自己的声音读传一段 1 到 5 分钟的干净录音就行格式不限背景杂音甚至配乐工具都会帮你做降噪。克隆质量基本取决于样本质量安静环境、语速平稳、内容贴近你要读的书效果就接近本人。1158 种语言。界面下拉框里能直接选语言冷门语种也能覆盖命令行下传 ISO-639-3 代码如 eng、zho即可。配合--translate参数还可以先把原文翻译成目标语言再朗读等于顺手把外语书转成母语有声书。输出与细节控制。成品支持 m4b、mp3、flac、wav 等十几种音频格式m4b 带章节标记可直接拖进播放器当有声书库管理。文本里还能埋入 SML 标签[break]、[pause]、[pause:3]插入长短短停[voice:音频路径]...[/voice]在同一段文字里切换说话人——做对话朗读时很实用。图2ebook2audiobook 音频生成参数页温度、重复惩罚、Top-k/Top-p 采样与长文本切分ebook2audiobook 语音参数推荐值四个最值得动的旋钮界面第二个标签页里滑块很多真正明显影响听感的就下面几个先按推荐值用不顺耳再微调。Temperature温度控制朗读的发挥空间。推荐值 0.65–0.75项目默认 0.75。小说调高一点更有戏剧感念说明书、教材调低读起来更平更稳。调到 0.1 附近会机械得念经调到 9 以上则容易蹦出奇怪的停顿和语调。Repetition Penalty重复惩罚推荐值 2.0–2.5。它管住模型别重复念同一段话。设太低会出现车轱辘话式复读拉满 10 又会把正常的语气词也压掉听着像漏字。Top-k Sampling采样宽度推荐值 40 左右。值越小选词越保守、生成越快、越不容易跑偏值越大80、100越丰富但偶尔冒出怪腔。追求速度就调低。Enable Text Splitting长文本切分长书建议开启。整本几十万字不切分会卡死或爆内存代价是官方也承认该功能效率一般切分处可能出现停顿不自然属正常现象。 新手最省事的路线所有滑块都不碰先听默认效果的 30 秒确实不顺耳再只动温度和重复惩罚这两个。ebook2audiobook 低配高配硬件方案对照表现代 TTS 模型对算力要求不低按机器档次选对路线能少走很多弯路硬件档位推荐处理器TTS 引擎适合做什么轻量≤8GB 内存无独显CPUTacotron2 / YourTTS短文本试读别指望 XTTS速度会慢到怀疑人生中配8–16GB 内存≥4GB 显存CUDA / MPSXTTS默认日常主力整本转换 语音克隆接近实时速度高配16GB 内存≥8GB 显存CUDAXTTS 自训模型上传微调后的自定义模型、整文件夹批量转换 GPU 没被识别到、界面里只有 CPU 可选项时多半是驱动版本和 CUDA 不匹配先按 README 里指向的 GPU 排查思路核对驱动再考虑指定--device。ebook2audiobook 命令行批量转换一次处理一整个书架图形界面适合单本书一次要转十几本时headless无界面模式更省事./ebook2audiobook.command --headless --ebooks_dir ./books \ --language eng --output_format m4b这条命令会把books目录里的书逐本转成 m4b。如果每本书想用不同声音再配一个 JSON 映射文件--voice_map格式是书名→声音文件路径命令行就能做到这本书男声、那本书女声。适合管理家庭有声书库、或固定流程制作儿童读物的人。ebook2audiobook 常见踩坑现象、原因与解法现象CPU 模式下一本书转得比熬汤还慢。原因默认引擎 XTTS 很吃 GPUCPU 硬跑接近不可用。解法CPU 机器把引擎换成 Tacotron2 或 YourTTS牺牲一点音色接近真人程度换速度短文本试读则完全够用。现象脚本停掉重启后浏览器页面白屏或提示连接断开。原因页面还连着旧进程服务已经换了新端口会话。解法直接刷新浏览器页面重连即可不是崩溃。现象中文、日文句子被拦腰截断或朗读语速忽快忽慢。原因分句逻辑对部分语言的断句习惯还没吃透切点切错了。解法这类问题需要按具体文本修规则把出问题的原文片段反馈到项目 issue 区维护者会据此调整分句逻辑。把书架里最薄的那本 EPUB 拖进界面选个默认声音按下 Convert——你的第一本自制有声书半小时后就能躺在播放器里了。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表