从零到首次启动:RVC-WebUI安装部署快速入门指南(Windows/Linux/macOS三平台)
【免费下载链接】rvc-webuiliujing04/Retrieval-based-Voice-Conversion-WebUI reconstruction project项目地址: https://gitcode.com/gh_mirrors/rv/rvc-webui
RVC-WebUI是一款开源的 RVC 语音转换(Retrieval-based Voice Conversion)Web 界面项目,是 liujing04/Retrieval-based-Voice-Conversion-WebUI 的重构版本。它把训练、推理、分轨等复杂流程做成了浏览器界面,新手也能在几分钟内完成安装并跑通第一次推理。本指南覆盖 Windows、Linux、macOS 三平台的一键启动步骤。
一、认识 RVC-WebUI:它能做什么?
在动手之前,先花 30 秒了解这个项目,能帮你避开很多弯路:
- 🎙️音色训练:用一小段干声人声训练属于自己的音色模型
- 🔄实时/文件推理:上传音频,用训练好的音色进行语音转换
- ✂️音轨分离:内置分轨功能(modules/separate.py)
- 🖥️纯浏览器操作:基于 Gradio 构建的 UI,无需安装客户端
项目采用"脚本 → 启动器 → WebUI"的三层结构,理解它能让你快速定位问题:
| 文件 | 作用 |
|---|---|
| webui-user.bat / webui-user.sh | 用户配置入口,可自定义 Python、Git 路径、启动参数 |
| webui.bat / webui.sh | 自动创建并激活虚拟环境,再调用启动器 |
| launch.py | 环境准备脚本:自动安装 torch、torchaudio 和依赖 |
| webui.py | 真正启动 Gradio Web 界面的入口 |
💡 官方测试环境:Windows 10 + Python 3.10.9 + torch 2.0.0+cu118(见 README.md)
二、部署前准备:环境要求清单
三大平台共需准备以下工具(安装顺序很重要):
- Git— 用于拉取代码与依赖检查
- Python 3.10(推荐版本,与测试环境一致)
- PyTorch(NVIDIA 显卡建议 cu118 版本;Mac 使用系统默认 MPS 后端)
- FFmpeg— 音频处理必需
各平台额外注意:
- Windows:若后续安装依赖报错
Microsoft Visual C++ 14.0 or greater is required,需先安装 Visual Studio 的C++ Build Tools(见 README.md 的 Troubleshooting 章节) - Linux:需要
python3-venv包;不要以 root 用户运行(webui.sh 会直接拒绝) - macOS:项目提供了 webui-macos-env.sh,自动设置
python3.10、MPS 回退开关等默认值,一般无需手动修改
三、Windows 一键启动(最简单)
步骤 1:获取代码
git clone https://gitcode.com/gh_mirrors/rv/rvc-webui进入rvc-webui目录。
步骤 2:双击启动
双击 webui-user.bat 即可。脚本会自动完成:
- 检测 Python 与 pip 是否可用(webui.bat)
- 在
venv目录创建/激活虚拟环境(webui.bat) - 执行
launch.py,自动安装 torch + 全部依赖(launch.py) - 启动 Web 界面(launch.py → webui.py)
首次启动需要下载依赖,请耐心等待几分钟。启动成功后浏览器会自动打开,地址类似http://127.0.0.1:7860。
⚙️ 想自定义参数(如指定 GPU、端口),只需编辑 webui-user.bat 中的
COMMANDLINE_ARGS变量,例如set COMMANDLINE_ARGS=--port 8080。
四、Linux 快速部署
步骤 1:安装基础工具
# Debian/Ubuntu 示例 sudo apt install git python3.10 python3.10-venv ffmpeg步骤 2:克隆并启动
git clone https://gitcode.com/gh_mirrors/rv/rvc-webui cd rvc-webui bash webui.shwebui.sh 的工作流程:
- 读取 webui-user.sh 中的自定义变量
- 检查 Git 与 Python 是否已安装(webui.sh)
- 创建并激活
venv虚拟环境(webui.sh) - 执行
launch.py完成依赖安装并启动界面
⚠️ 若你使用AMD 显卡,脚本会自动切换为 ROCm 版 torch(webui.sh);其他情况可取消 webui-user.sh 中
TORCH_COMMAND的注释来指定 CUDA 版本。
五、macOS 启动步骤
macOS 与 Linux 共用 webui.sh,但会自动加载 webui-macos-env.sh 中的 macOS 默认配置:
- 优先使用
python3.10(webui-macos-env.sh) - 设置
PYTORCH_ENABLE_MPS_FALLBACK=1启用 Apple Silicon 的 MPS 加速回退(webui-macos-env.sh)
git clone https://gitcode.com/gh_mirrors/rv/rvc-webui cd rvc-webui bash webui.sh📌 如需调整 macOS 行为,请修改 webui-user.sh 而不是 webui-macos-env.sh——后者是"只读默认值",文件头部注释已明确说明这一点。
六、启动后:界面长什么样?
首次成功启动后,你会看到几个主要功能页签(源码位于 modules/tabs/):
| 页签 | 源码 | 功能 |
|---|---|---|
| 推理 | inference.py | 选择音色 + 上传音频 → 一键变声 |
| 训练 | training.py | 处理干声 → 训练专属音色模型 |
| 分轨 | split.py | 人声与伴奏分离 |
| 合并 | merge.py | 音轨合并 |
| 服务端 | server.py | 局域网/API 调用 |
新手建议的第一条路径:推理页签 → 选择一个预训练音色(放入 models/checkpoints/)→ 上传一段音频 → 点击转换,几分钟内就能听到变声效果。
七、常见问题速查(FAQ)
❓启动后浏览器没自动打开?手动访问终端中提示的地址(默认
http://127.0.0.1:7860)。可通过--port参数更换端口(modules/cmd_opts.py)。❓依赖装得太慢或失败?国内网络可考虑配置 pip 镜像源;依赖清单见 requirements/main.txt(核心为 gradio、torch、faiss-cpu、librosa 等)。
❓显存不够用?项目支持
--medvram --opt-split-attention等参数(见 webui-user.sh 注释示例),并可用--precision fp32在 fp16/fp32 间切换(modules/cmd_opts.py)。❓想拉取更新?项目提供了 update.sh(Linux/mac)和 update.bat(Windows)更新脚本。
❓模型文件放哪里?音色模型放 models/checkpoints/,语义嵌入放 models/embeddings/,预训练权重放 models/pretrained/;训练输出在 outputs/。
八、进阶:训练你自己的音色
跑通推理只是开始。RVC 的核心乐趣在于训练专属音色模型:
- 准备 10~30 分钟干声(无人声伴奏、无混响)人声
- 训练流程会经过切片(slicer.py)、F0 提取(extract_f0.py)、特征提取(extract_feature.py)等步骤
- 采样率配置可按需选择,configs/ 下提供了 32k/40k/48k 三档采样率、768 维与常规两套配置,如 40k.json、48k-768.json
- 训练逻辑位于 lib/rvc/train.py,损失函数见 lib/rvc/losses.py
训练产物会自动保存到 models/training/models/,之后即可在推理页签中使用你的音色。
总结
RVC-WebUI 的安装门槛已经被降到了"双击脚本"的级别:
- Windows:双击 webui-user.bat
- Linux:
bash webui.sh - macOS:
bash webui.sh(自动加载 macOS 优化配置)
首次启动会自动创建虚拟环境并装好全部依赖,耐心等待即可。完成本文后,你已经从"零"走到了"第一次听到自己的 RVC 变声",接下来就可以深入训练页签,打造专属音色了。
【免费下载链接】rvc-webuiliujing04/Retrieval-based-Voice-Conversion-WebUI reconstruction project项目地址: https://gitcode.com/gh_mirrors/rv/rvc-webui
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考