VoxWeave

一款在 Windows 本机运行的 RVC 变声工具,不用联网就能处理音频和实时麦克风变声。装完就能在电脑上把声音换成别的音色,支持录好的文件和实时说话两种场景。

Github地址

https://github.com/CheshireMew/VoxWeave

功能特性

  • 转语音、歌曲、视频:输出不覆盖原文件,视频会多一条变声音轨
  • 实时麦克风变声:选好播放设备,说话直接变声输出,有三档延迟可选
  • 批量处理:扔进去整个文件夹,自动排队,重复内容会跳过
  • 接脚本或别的工具:本机开了 HTTP/WebSocket 接口,返回标准 JSON

快速开始

1. 使用 EXE

双击 VoxWeave.exe 后,程序会先发现现有 VoxWeave 数据、RVC 环境及 FFmpeg。找到已有环境就直接复用;否则自动选择空间充足的非系统盘创建 VoxWeave 数据目录。只有找不到合适磁盘时才要求手动选择。EXE 所在目录保存数据目录指针和运行组件检查结果;可能很大的运行组件、模型、缓存、日志和任务产物保存在数据目录。NVIDIA 完整首次安装要求至少 12 GiB 可用空间。

程序会自动检查检测到的运行环境。完整环境可直接使用;只缺 FFmpeg 时,“补全缺失组件”只补 FFmpeg;现有 RVC 自检不通过时,程序会弹窗说明安装内容、保存位置和空间要求,用户确认后才下载锁定版本的 Python 3.12、RVC 和 FFmpeg。模型库为空时,程序会自动扫描现有 RVC 的 assets\weights 和索引目录;仍然没有模型时,会弹窗询问是否下载“青年男声 + 学姐女声”两款入门音色。取消确认不会产生下载任务,其余中文音色仍可在模型库按需选择。

2. 从源码运行

源码开发需要 Python 3.12 和 Git。运行数据必须放在源码目录之外;Python 环境、pip 缓存、临时文件、数据库、日志、下载和任务产物都会进入这个数据目录。

1
git clone https://github.com/CheshireMew/VoxWeave.gitcd VoxWeave.\scripts\bootstrap.ps1 -DataRoot D:\Tools\VoxWeave

如果你已经有锁定兼容版本的 RVC 环境,可以在首次配置时一并声明:

1
2
3
4
5
6
.\scripts\bootstrap.ps1 `
-DataRoot D:\Tools\VoxWeave `
-RvcRoot E:\path\to\Retrieval-based-Voice-Conversion-WebUI `
-RvcPython E:\path\to\Retrieval-based-Voice-Conversion-WebUI\.venv\Scripts\python.exe `
-Ffmpeg D:\path\to\ffmpeg.exe `
-Ffprobe D:\path\to\ffprobe.exe

requirements.lock 是 Windows/Python 3.12 的已验收依赖集合,首次配置和 CI 使用同一约束文件。源码目录只保留一个被 Git 忽略的 .voxweave.local.json 数据目录指针。

3. 启动源码桌面端

直接双击仓库根目录的 VoxWeave.vbs,即可无控制台窗口启动。需要查看启动错误时,在 PowerShell 中运行:

1
.\scripts\run.ps1

VoxWeave.bat 只负责把旧快捷方式转交给 VoxWeave.vbs,随后立即退出。源码更新后,先用 .\scripts\voxweave.ps1 service stop 正常关闭旧服务,再重新启动桌面端。

4. 没有 RVC 环境时安装运行组件

先启动桌面端,让本机服务可用;然后在新的 PowerShell 窗口提交安装任务:

1
.\scripts\voxweave.ps1 --json execute runtime.install --arguments '{}'

安装任务把锁定的 Python、RVC 源码、FFmpeg 和必需推理资源放入数据目录,只安装 VoxWeave 实际使用的推理、实时音频、模型检查和语音分析依赖,不安装 RVC 网页界面、训练面板、Gradio 或 TensorBoard。默认不会下载许可证无法确认的人声分离权重;WeSpeaker ONNX 权重按 CC-BY-4.0 安装。完整边界见 第三方说明。

5. 完成第一次转换

  1. 在“模型库”下载推荐模型、扫描本机目录,或添加你有权使用的 .pth 和可选 .index
  2. 打开“转换工作台”,选择输入文件、输出位置和目标模型。
  3. 先生成试听,确认音高、F0、索引率等参数,再开始完整转换。
  4. 在“任务中心”查看进度;完成后可播放或打开最终产物。

VoxWeave 默认不覆盖已有输出。提交任务时会固化输入文件、模型和索引身份,执行前后再次验证;结果清单记录最终文件及 SHA-256,避免重试时悄悄换用已经变化的素材或模型。