语音上手难度 ⚡ 入门#语音克隆#TTS#配音#转录#本地部署#有声书#646语言
VoiceStudio · VoiceStudio 语音工作室
GitHub 27k⭐:开源本地版 ElevenLabs,语音克隆+配音+转录+有声书,支持 646 种语言
指标同步中,请稍后刷新查看 在 GitHub 查看源码
5 分钟上手
推荐 8GB+ 显存 GPU,使用 TTS/语音克隆功能需要 GPU 加速# 桌面版(开箱即用):下载安装包即可运行
# Python 库:
pip install voicestudio
python -m voicestudio --clone --sample voice.wav --text "你好世界"项目速览
VoiceStudio 是一个完全本地运行的开源 ElevenLabs 替代方案,提供语音克隆、语音设计、视频配音、听写转录和有声书创建等全链路语音功能,支持 646 种语言。所有处理在本地完成,不需上传任何音频数据到云端,兼顾性能和隐私。集成了最新的 TTS、语音克隆和语音识别模型。
能做什么
- 语音克隆:用短音频样本克隆任何人的声音
- 语音设计:从零设计自定义声音(音色、语调、风格)
- 视频配音:自动语音识别+配音,支持多语言
- 听写&转录:高精度语音转文字,支持 646 种语言
- 有声书创建:文本批量转有声书,支持多章节
- 完全本地运行:所有处理在本机完成,不上传任何数据
怎么部署
提供桌面应用(Windows/macOS/Linux)和 Python 库两种使用方式。桌面版开箱即用,Python 库适合集成到自有工作流。
适合谁
需要本地语音处理解决方案的内容创作者、关注隐私的配音/翻译/有声书从业者、需要离线语音能力的企业用户。
✅ 优点
- •完全本地运行,音频数据不出设备
- •功能覆盖面广:克隆/设计/配音/转录/有声书一站式
- •支持 646 种语言,远超同类产品
- •提供桌面应用,非技术用户也能用
⚠️ 局限与坑
- •语音克隆质量与 ElevenLabs 等云端方案仍有差距
- •部分语言模型加载较慢,需要大内存
- •项目更新频繁,API 稳定性有待观察
💼 典型应用场景
- 1.本地语音克隆和自定义声音设计
- 2.视频多语言配音与转录
- 3.文字转有声书批量制作
不想部署?试试同类在线工具
语音· 同类项目推荐
返回全部开源项目指标每周自动更新,数据来自 GitHub API