
VoiceStudio安装配置完全指南macOS、Windows、Linux与Docker一键部署【免费下载链接】VoiceStudioVoiceStudio is the open-source, fully-local ElevenLabs alternative — voice cloning, voice design, video dubbing, dictation, transcription audiobook creation in 646 languages.项目地址: https://gitcode.com/GitHub_Trending/om/VoiceStudioVoiceStudio 是一个开源、完全本地运行的语音克隆工具可视为 ElevenLabs 的免费替代方案——语音克隆、语音设计、视频配音、实时听写、语音转文字与有声书制作覆盖 646 种语言且无需注册账号、API 密钥或订阅费用。这篇 VoiceStudio 安装配置指南将带你从零开始完成部署先核对硬件要求再分别走通 macOS、Windows、Linux 与 Docker 四条安装路径最后完成首次启动配置与自检全程约 10 分钟即可用上本地语音引擎。安装前准备硬件要求3分钟核对VoiceStudio 默认工作在本地首次启动会自动创建 Python 环境并下载约 2.4 GB 的默认模型权重因此建议预留10 GB 磁盘空间。配置项最低要求推荐配置操作系统Windows 10 x64 · macOS 13.3Apple Silicon· Linux x86_64glibc 2.39当前受支持的稳定版本内存8 GB16 GB 以上磁盘10 GB 可用20 GB 以上 SSDGPU可选支持纯 CPU 模式NVIDIA CUDA 或 Apple Silicon显存使用 GPU 时 4 GB8 GB 以上 关键点Apple Silicon Mac、NVIDIA 显卡可自动获得 GPU 加速AMD 显卡在 Windows 上仅能走 CPU在 Linux 上可启用 ROCm。没有独立显卡也能跑只是速度更慢。四种部署方式怎么选平台安装包适用场景官方文档macOS 13.3Apple SiliconDMG日常桌面使用docs/install/macos.mdWindows 10/11 x64MSI含当前用户版免管理员日常桌面使用docs/install/windows.mdLinux x86_64AppImage桌面 轻量服务器docs/install/linux.mdLinux/AMD64Docker 镜像CUDA/ROCm/CPU无头服务器、专用 GPUdocs/install/docker.md所有安装包都从官方 Releases 页下载下载后拖拽/双击安装即可无需自备 Python、FFmpeg 等工具链——这些都由应用首次启动时自动引导。macOS安装Apple Silicon用户一键搞定macOS 13.3Ventura以上、Apple SiliconM1–M4机型是最省心的选择从 Releases 下载aarch64后缀的 DMG双击挂载后把 VoiceStudio.app 拖入/Applications首次启动macOS Gatekeeper 会提示无法验证开发者。这是开源构建的正常现象右键点击应用 → 打开 → 再次确认打开一次性放行即可macOS 15 可在系统设置 → 隐私与安全性中点仍要打开首次启动会自动创建 Python 环境并下载默认模型启动画面会显示每一步的实时进度。⚠️Intel Mac 注意由于 PyTorch 已停止提供 Intel Mac 版安装包Intel 机型无法运行本地后端只能搭配远程后端使用。详见 docs/install/macos.md。Windows安装MSI向导式部署支持免管理员安装从 Releases 下载 MSI 安装包按向导安装。两个版本按需选择安装包安装范围是否需要管理员VoiceStudio_版本_x64_en-US.msi整台机器Program Files是VoiceStudio_Current_User_版本_x64_en-US.msi仅当前用户否GPU 加速NVIDIA 显卡 普通驱动即可自动启用 CUDA无需装 CUDA ToolkitAMD 显卡在 Windows 上走 CPU 模式安装完成后首次启动会自动完成 Python 环境与模型下载如果 C 盘空间紧张可在设置 → 存储 → 模型目录中把几十 GB 的模型数据迁移到其他磁盘。 进阶玩法Windows 版还支持Portable 便携模式——在首次启动设置页选择 Portable 并指定数据目录整个安装含模型、音色、项目就集中在一个文件夹里可直接拷到 U 盘走人。Linux安装AppImage两条命令启动适用于 Debian / Ubuntu / Fedora / Arch 等发行版需 glibc 2.39chmod x VoiceStudio.Studio_*.AppImage ./VoiceStudio.Studio_*.AppImage如果系统缺少 FUSE改用./VoiceStudio.Studio_*.AppImage --appimage-extract-and-run若启动后出现白屏终端报EGL_BAD_PARAMETER加一个环境变量重试WEBKIT_DISABLE_DMABUF_RENDERER1 ./VoiceStudio.Studio_*.AppImageNVIDIA 驱动装好后自动启用 CUDA 加速AMD 显卡可启用 ROCmLinux 独占。完整步骤见 docs/install/linux.md。Docker一键部署无头服务器与专用GPU首选Docker 镜像内置后端UI 通过浏览器访问适合一条命令部署。官方镜像仅支持linux/amd64Apple Silicon 建议直接用原生 macOS 应用。第一步生成管理员密钥Web 版首次打开时需要export OMNIVOICE_API_KEY$(python3 -c import secrets; print(secrets.token_urlsafe(32)))第二步按硬件启动容器# CPU 版 docker run -d --name omnivoice \ -p 127.0.0.1:3900:3900 \ -e OMNIVOICE_API_KEY$OMNIVOICE_API_KEY \ -v omnivoice-data:/app/omnivoice_data \ ghcr.io/debpalash/omnivoice-studio:latest # NVIDIA GPU 版加一行 --gpus all第三步浏览器打开http://localhost:3900输入 API 密钥用docker logs -f omnivoice观察首次约 2.4 GB 模型下载。⚙️ 推荐用 deploy/docker-compose.yml 管理docker compose -f deploy/docker-compose.yml --profile cpu up -dGPU 换--profile gpuAMD 换--profile rocm。镜像标签建议生产环境锁定:stable:latest是滚动预览版。镜像构建细节见 deploy/Dockerfile。安装完成后三步完成核心配置无论哪种方式部署首次启动后建议按顺序做三件事1️⃣ 确认引擎与设备。打开模型目录Model Catalogue查看 TTS/ASR 引擎的可用状态、GPU 兼容性与安装状态用Ctrl/CmdE可随时快速切换引擎。2️⃣可选配置 Hugging Face Token。进入设置 → API Keys填入 Token说话人分离等高级模型是受管模型有 Token 下载更快更稳。国内网络可在设置 → Models中切换 HF 镜像站。3️⃣ 生成第一条语音验证安装进入Voice Cloning标签 → 上传 5–15 秒的清晰人声样本 → 输入文字、选择语言 → 点击Generate。听到合成语音说明安装配置全部成功 ✅。配置失败怎么办一次自检定位问题遇到问题别慌VoiceStudio 内置了完整的诊断体系图形界面设置 → About → Run self-check一键检查计算设备CUDA/MPS/CPU、FFmpeg、磁盘空间、模型完整性等每项都有修复提示终端uv run python backend/main.py --diagnose --deep深度检查还会加载引擎并合成测试语句应用内报错界面自带Open docs for this error按钮可直接跳转到对应错误文档高频问题杀毒软件误删文件、torch 版本不匹配等的完整修复清单在 docs/install/troubleshooting.md。总结普通用户macOS Apple Silicon 选 DMG、Windows 选 MSI无管理员权限选 Current_User 版、Linux 选 AppImage拖拽安装 首次启动自动配置是最快的路径服务器/独享 GPU 用户Docker 一条命令部署--gpus all或 ROCm 变体按需选择装完之后模型目录确认引擎、可选配 HF Token、克隆一条语音验证三件事做完就可以开始创作了。所有音频与项目默认保存在本地机器上本地工作流无需账号、无需网络——这正是 VoiceStudio 作为本地语音工作台的独特价值。【免费下载链接】VoiceStudioVoiceStudio is the open-source, fully-local ElevenLabs alternative — voice cloning, voice design, video dubbing, dictation, transcription audiobook creation in 646 languages.项目地址: https://gitcode.com/GitHub_Trending/om/VoiceStudio创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考