POSTPREP / VOICE STUDIO
AI 变声器
选择声线,载入音频,调整音高并转换。
使用提示
使用提示
角色音色来自各模型的许可情况,请仅将变声结果用于你有权使用的场景,并为 AI 生成内容做清晰标注。请勿用他人声音冒充本人或用于欺骗。
WORKSPACE / 01
声音工作台
INFERENCE MODE
处理模式
云端
INFERENCE MODE
处理模式
1. 选择角色声音
选择分区与声线。
角色目录与来源
导入与训练模型
导入我自己的模型
选择本机 .onnx 模型;不会上传或公开。
上传纯人声并训练新的 RVC v2 模型
选择 2–12 段你有权使用的纯净单人人声。系统按固定官方 RVC v2 路线执行数据切分、RMVPE 音高、HuBERT 特征、预训练权重微调和 FAISS 索引。训练由本机 GPU 后台执行,旧角色与普通变声代码不被替换。
尚未选择训练音频。
2. 提供你的声音(任选其一)
纯人声最长 20 分钟,云端翻唱最长 15 分钟;文件限 25 MB。
音频内容
音频模式说明
沿用原有稳定链路,上传更省流量。
云端先分离人声,只变人声,再与原伴奏回混。
纯人声模式不会启动伴奏分离,原功能与音质参数保持不变。
按声区匹配初始参数,声区不确定时保持原调;每路可独立微调。手动人数不会强制生成重复声部。三/四路为实验功能,请预听检查串音。
先提取歌手,逐路预听、分配角色和独立调音,再点击「开始变声」。此功能使用云端引擎。
尚未选择音频文件。
3. 调节声音与音调匹配0
默认保持原调;跨音域时逐步调节。
分析原声声区并匹配角色。手动调整优先;变调会改变歌曲调性。
当前为 0 半音:先保留输入的自然音高;需要跨音域时再试听小幅调整。
高级参数
仅新版讲话支持。更多步数更慢,不保证更好;滑块每次调整 1 步。当前引擎每个窗口使用统一步数,不支持高中低音逐帧变步。
稳定模式已启用:默认固定检索与辅音保护;可选连续声区保护,变调补偿默认关闭。没有索引的角色不使用检索。
越高音色越贴近角色,但会增加颗粒风险。建议 0.20–0.40。
数值越低,清辅音与呼吸保护越强;0.5 会关闭保护。高动态输入建议 0.20–0.30。
云端 RVC:高音更积极调整检索与辅音保护,低音保持温和;0 保持固定参数,不改旋律。
可选:最多 ±2 半音连续补偿,会改变部分音程;默认 0 保留原始旋律。
音高提取算法
云端可选;设备端固定使用 RMVPE。自动模式会在结果中显示实际算法。
输出格式
智能格式(手机 MP3 · 电脑 WAV)
输出采样率
跟随角色模型(40 / 48 kHz)
0 更贴近原唱音量,1 保留模型原始动态;云端与设备端含义一致。
人声与伴奏独立混音
MIX / STEMS
人声与伴奏独立混音
先设置比例再变声;结果生成后可点“更新混音”,无需重新分离或变声。
调整后点击更新混音,预听与下载会同步更新。短期分轨最多保留约 2 小时。
正在就绪变声引擎;此检查不会上传音频。