首页
/
Audiblez
基本信息
- 工具类别: 开源&免费
- 收录时间: 2026-08-11
- 访问次数: 37
- 评分: 4.2
- 官网: https://github.com/santinic/audiblez
工具详情
Audiblez 开源自动有声书生成工具
一、平台介绍与定位
- 核心定位:Audiblez 是一个轻量化、离线运行的电子书转有声书本地工具。其主要功能在于帮助用户在不依赖云端服务的状态下完成从文本到语音的转换。
- 技术核心模型:基于开源超轻量级 TTS(文本转语音)模型 Kokoro-82M。该模型参数量仅为 8000 万,具备体积小巧、发音自然流畅以及推理速度极快的显著特点。
- 项目来源信息:由开发者 Claudio Santini(Github ID:
santinic)开发并维护。开源地址为 santinic/audiblez。
二、主要功能清单
- 章节自动处理与打包能力:读取 .epub 格式电子书文件内容。系统会自动将书籍按章节拆分生成音频,最后利用 ffmpeg 工具将所有音频合并为标准格式的 .m4b(支持播放器识别)。
- 多语言音色广泛覆盖:内置了数十种男女声音色选项。支持美式英语、英式英语、中文普通话、日语等语种。具体包含如中文的
zf_xiaoxiao、zm_yunxi等多种人声选择。 - 交互式章节挑选功能:命令行使用 --pick 参数启动交互模式。用户可以手动勾选仅需转换的特定章节,避免整书生成的资源浪费与时间消耗。
- 语速个性化调节支持:提供灵活的速度控制选项。支持从 0.5x(慢读)到 2.0x(快听) 的范围调整需求,适应不同阅读场景。
- 双形态操作界面设计:既提供命令行 CLI 接口供批量自动化处理。同时也提供了图形界面(GUI),方便不熟悉终端代码的普通用户直观操作使用。
- 多硬件加速兼容性策略:支持 CPU 推理与 NVIDIA GPU CUDA 加速。可根据设备配置选择纯软件运行或显卡全速运算模式。
三、适用人群群体分析
- 有声书爱好者读者群:希望将大量下载的 EPUB 格式电子书转换为音频文件。主要用于收藏后的离线收听需求,提升个人媒体库的可听性。
- 隐私敏感与零成本用户:对在线 AI(如 ElevenLabs)的订阅费用及流量使用有所顾虑。追求完全本地化、全离线处理流程且无需支付任何费用的人群。
- 外语语言学习者辅助者:利用多语种自然音色制作双语材料。主要用于英语学习或法语等其他小语种的听力训练与练习。
- 开发者与 Homelab 玩家群:希望在个人 NAS、Google Colab 或本地服务器上部署脚本。希望实现批量自动化生成有声书的运维人员与技术用户群体。
四、免费付费情况说明
- 完全开源协议授权性质:项目采用 MIT 开源协议,底层模型使用 Apache-2.0 协议。代码与资源对公众开放,无任何闭源或隐藏费用成分。
- 零成本本地运行机制:不依赖任何云端 API 接口。所有的计算都在你自己的设备(如电脑 GPU)上运行,不存在官方付费方案或非官方的收费页面。
- 信息获取渠道说明:所有最新技术与维护均以 GitHub 项目主页为准。地址指向
https://github.com/santinic/audiblez,确保信息的即时性与准确性。
五、核心使用方法与安装指令
- 前置依赖环境配置要求:
- Audiblez 运行需要系统中预装以下组件:python3(基础语言)、用于音频打包的
ffmpeg和语音合成分词器espeak-ng。
- 系统特定安装包命令示例:
- [macOS] Homebrew 环境安装步骤:bash
brew install ffmpeg espeak-ng pip install audiblez
- [Ubuntu / Debian] APT 包管理器工具安装:bash
sudo apt install ffmpeg espeak-ng pip install audiblez
- [Windows] Python 虚拟环境标准流程(建议): **注意在 Windows 系统优先使用虚拟环境,避免污染全局库。**依次执行以下
cmd/PowerShell指令:构建目录并创建激活脚本。 - cmd
mkdir audiblez && cd audiblez python -m venv venv .\venv\Scripts\activate.ps1 pip install audiblez pillow wxpython
- 功能执行与参数化转换命令:
- **[默认全书转换操作] 基础用法示例:**使用
-v后填写音色代号,如美式英语af_sky。请替换文件名为你的具体 EPUB 名称。 - bash
audiblez your_book.epub -v af_sky
- **[调节语速播报指令] 加速播放设置:**添加
-s参数设定速率,例如 1.5倍速(范围支持 0.5x-2.0x)。 - bash
audiblez your_book.epub -v af_sky -s 1.5
- **[交互式章节选择指令] 仅转换选定内容:**使用
--pick参数启动交互界面。系统会列出所有章节供你手动勾选需要生成的部分。 - bash
audiblez your_book.epub --pick
- 性能优化与硬件加速配置:
- **[CPU/GPU/CUDA 开关] GPU 加速模式:**若设备装有 NVIDIA 显卡,使用
--cuda参数显式开启。这能显著提升大书的生成速度(例如 Google Colab T4 环境下 16 万字仅需约 5 分钟)。 - bash
audiblez your_book.epub --cuda
- **[图形界面入口指令] GUI 可视化操作:**不习惯命令行时,可直接输入以下命令启动桌面端窗口。该模式适合进行章节选择与参数配置的直观管理。
- bash
audiblez-ui
六、注意事项与性能说明
- 文件格式兼容性限制:目前原生支持仅针对 .epub 格式电子书。如果是 PDF、TXT 或 AZW3,需预先使用 Calibre 等工具转换为标准 EPUB。
- CPU/GPU 速度预期对比:**在免费 GPU(如 Google Colab T4)**环境下处理效率更高;而在纯 CPU(如 M2 Mac)上推理同一内容可能需要长达约1小时。建议长文优先开启 GPU。
- 依赖项缺失风险预警:如果电脑中未成功安装
ffmpeg,程序生成完单章的 .wav 声音文件后无法打包成最终的 .m4b 格式音频包。务必检查 ffmpeg 是否在系统环境变量路径下可被调用。 - Apple Silicon (M1/M2/M3) 优化状态说明:底层主要依赖 PyTorch CPU/CUDA架构,尚未完全原生适配 Apple MLX 框架加速。Mac M 系列用户运行速度受限,长文本处理建议借用 Google Colab 等云端算力执行。
暂无评论