资讯动态

RVC 语音转换 WebUI 十分钟跑通指南:面向新手的变声实战

发布时间:2026/9/1 20:59:41 来源:尧图企业网站定制
RVC 语音转换 WebUI 十分钟跑通指南面向新手的变声实战【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI这是一个基于 RVCRetrieval-based Voice Conversion的语音转换框架打开浏览器 WebUI上传音频文件就能把声音变成目标音色。它用不到 10 分钟的干净语音数据就能训练出可用的变声模型不需要你懂深度学习原理。RVC 是什么浏览器里的变声工作台RVC 是一个基于 VITS 的语音转换VC框架用 Gradio 把训练和推理都做成了网页界面。它解决的核心痛点是训练变声模型麻烦、数据少效果差通过 top1 特征检索杜绝音色泄漏自己的音色混进输出在入门级显卡上也能快速训练和推理。核心功能速览你能用它做什么功能一句话说明一键语音转换在 WebUI 上传音频选模型和索引点击转换即得变声结果一键训练音色模型放入 10 分钟语音一键跑完数据处理、音高提取、模型训练、索引构建实时变声双击go-realtime-gui.bat启动实时变声界面端到端约 170ms 延迟人声/伴奏分离内置调用 UVR5 的能力快速把歌声从歌曲里分离出来音色模型融合用 ckpt-merge 功能融合多个 .pth 模型微调出更满意的音色环境准备与最快启动步骤最低硬件与软件要求系统Windows / Linux / macOSmacOS 有专门的run.sh脚本Python推荐 3.8若用 Poetry 安装依赖3.7~3.10 都稳定版本过新会装不上显卡NVIDIA 卡最佳PyTorch CUDA 加速AMD/Intel 卡可走 DML 路线ffmpeg必须安装负责所有音频读写三步跑通第 1 步获取代码git clone https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI第 2 步安装依赖在项目目录内执行pip install torch torchvision torchaudio pip install -r requirements.txt sudo apt install ffmpegmacOS 用brew install ffmpegA 卡或 I 卡用户把第二条换成pip install -r requirements-dml.txtWindows RTX 30xx 的用户建议给 PyTorch 指定 CUDA 11.7 的轮子pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu117。第 3 步下载预训练模型并启动./tools/dlmodels.sh python infer-web.py --port 7897dlmodels.sh会把 hubert、pretrained 等底模拉到assets/Windows 双击tools/dlmodels.bat。启动后浏览器打开http://127.0.0.1:7897就是 RVC WebUI。习惯 Windows 的话也可以直接双击go-web.bat效果等同。关键目录与配置速查按对你有什么用分组来看入口脚本组infer-web.py是训练 推理 WebUI 的主入口go-web.bat、go-realtime-gui.bat是 Windows 一键启动脚本run.sh是 macOS/Linux 的一键装依赖 下模型 启动脚本。模型权重组assets/放运行必需的底模hubert/、pretrained/、pretrained_v2/、uvr5_weights/等assets/weights/放你自己训练出的 .pth 音色模型assets/indices/放 .index 特征检索库。缺哪个文件就按 README 的清单补到这里。配置依赖组requirements.txt是 N 卡依赖清单requirements-dml.txt是 A/I 卡版configs/里是 v1/v2 不同采样率32k/40k/48k的训练配置日常不用动。文档许可组docs/有多语种 README、FAQ 与训练技巧LICENSE是 MIT 协议。其余核心代码集中在infer/推理、训练、UVR5 模块和tools/模型下载、CLI 与批量推理不折腾源码可以完全不看。新手高频坑与一句话解法坑一句话原因一句话解法装依赖时llvmlite/numba报错Python 版本过新与锁定版本冲突换 Python 3.8 重建虚拟环境重装启动或转换时报 ffmpeg 相关错误音频工具链没装sudo apt install ffmpegmacOS 用brew install ffmpegWindows 把 ffmpeg.exe 放根目录训练时显存爆掉batch size 按默认值偏大调小 WebUI 里的 batch_size或开启半精度训练界面提示预训练模型不存在底模没下到assets/跑tools/dlmodels.shWindows 双击dlmodels.batWindows 上 PyTorch 与 CUDA 版本对不上装了不带 CUDA 或版本错配的轮子指定 cu117 索引源重装 PyTorch延伸资源README.md环境配置、模型下载清单、启动方式一切细节以此为准docs/cn/faq.md中文常见问题解答docs/cn/Changelog_CN.md中文更新日志tools/模型下载脚本与命令行、批量推理工具跑通后先拿一段歌声在单次推理里试一次转换再去训练页走一遍一键训练流程跟着界面提示填参数即可上手。【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价