
10分钟语音克隆RVC WebUI 实操记录【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI在直播间翻唱一首歌时变声器能给你的只有嗲了一点的自己——音色还是你的效果也谈不上自然。Retrieval-based-Voice-Conversion-WebUI简称 RVC WebUI是一个开源的语音转换/变声器框架它要解决的正是这个问题把 10 分钟的目标语音喂给它训练一个模型之后你说唱出来的声音就长成了那个人的音色全程网页操作不用记命令行。 先看清它能做什么、不能做什么小数据训出可用模型官方建议 10–50 分钟低底噪训练音频精简且音色有特色时 5–10 分钟也能出活不用对着麦克风录一整个下午。网页界面一站式人声伴奏分离、数据切分、一键训练、单次/批量推理都在浏览器里点完界面自带中英等多语言。实时变声可用配套实时变声程序端到端延迟约 170ms配合 ASIO 音频设备可压到 90ms 左右直播、连麦撑得住。它不是 TTS你得先唱/说出输入音频它负责把音色换人不能输入文字直接发声训练集如果底噪大、音色没特色效果也会跟着打折。维度RVC WebUI传统变声器声音来源用 10 分钟目标语音训练模型实时调音高/音品音色相似度能接近目标声音音色不变只变声线实时延迟约170msASIO下约90ms低硬件要求建议 4G 以上显存的显卡几乎没有⌨️ 装好到跑起来就这几步整个上手是一条连贯的线克隆仓库装好 Python 3.12 后按显卡情况装依赖NVIDIA 卡选对应 CUDA 版本的依赖文件如requirments_cu118_py312.txtCPU/核显用户装 CPU 版再从官方模型仓库把预训练底模和 RMVPE 音高模型下载到assets/对应目录最后一条命令启动git clone https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI cd Retrieval-based-Voice-Conversion-WebUI python webui.py浏览器会自动打开默认端口 7865 的页面Windows 用户其实可以直接双击根目录的 go-webui.bat 跳过前两步。界面里 UVR5、数据切分、一键训练、推理等选项卡按顺序点下来就是完整的训练流程。 实际用起来是什么样把你的翻唱变成他的声音。训练好模型后进入推理选项卡下拉框选中模型把你的干声 wav 拖进去音高偏移填半音数升八度 12、降八度 -12音高提取算法保持默认的 RMVPE点转换。几秒后得到结果音频——旋律和咬字还是你的音色已经换成了训练目标的那个。一个文件夹批量过。单次推理旁边就是批量推理指定一个装了几十个音频的文件夹选导出格式 wav 或 mp3它会逐个转换并输出到 opt 文件夹。想把一整张专辑的翻唱都借声一遍丢进去挂机就行。麦上实时变声。运行实时变声程序Windows 下双击 go-realtime_gui.bat选模型、指定输入输出音频设备说话即变声。README 给出的数字是端到端 170ms用 ASIO 设备约 90ms体感接近自己的回声延迟直播连麦基本无感。 几个值得记下的坑转换时提示 ffmpeg error 或 utf8 error大概率是路径问题把音频路径里的空格、括号、中文字符去掉基本就好了。训练报 CUDA out of memory先把每张卡的 batch_size 调小再试4G 显存还能抢救3G 及以下的卡建议换机器。变完声漏出原声音色听起来像两个人混在一起时把检索特征占比index_rate往上调默认 0.75 是个稳妥起点——这正是这个项目名字里检索式的用处但若训练集本身音质一般拉太高也不会把音质变好。浏览器里突然 Connection Error十有八九是你把黑色的控制台窗口关了留着它就没事。效果不像目标声音时先怀疑训练集而不是模型底噪大、时长不够 10 分钟、音色没有辨识度是三个最常见的原因。值不值得花时间回到开头那个直播间翻唱的场景如果你手上有至少 10 分钟干净的目标声音、显卡有 4G 显存往上花一个下午折腾下来是能收获换个嗓子唱歌的体验的但如果你期待的是输入文字就用那个人的声音念出来那属于 TTS 的活儿去别的项目看。遇到具体报错可以先翻仓库里的中文常见问题docs/cn/faq.md。【免费下载链接】Retrieval-based-Voice-Conversion-WebUIEasily train a good VC model with voice data 10 mins!项目地址: https://gitcode.com/GitHub_Trending/re/Retrieval-based-Voice-Conversion-WebUI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考