POSTPREP / VOICE STUDIO

AI 变声器

选择声线,载入音频,调整音高并转换。

使用提示

使用提示

角色音色来自各模型的许可情况,请仅将变声结果用于你有权使用的场景,并为 AI 生成内容做清晰标注。请勿用他人声音冒充本人或用于欺骗。

WORKSPACE / 01

声音工作台

用完即删

INFERENCE MODE

处理模式

云端
设备端模型保存在浏览器缓存中

1. 选择角色声音

选择分区与声线。

导入与训练模型

导入我自己的模型

选择本机 .onnx 模型;不会上传或公开。

上传纯人声并训练新的 RVC v2 模型

选择 2–12 段你有权使用的纯净单人人声。系统按固定官方 RVC v2 路线执行数据切分、RMVPE 音高、HuBERT 特征、预训练权重微调和 FAISS 索引。训练由本机 GPU 后台执行,旧角色与普通变声代码不被替换。

尚未选择训练音频。

2. 提供你的声音(任选其一)

纯人声最长 20 分钟,云端翻唱最长 15 分钟;文件限 25 MB。

音频内容

音频模式说明

沿用原有稳定链路,上传更省流量。

云端先分离人声,只变人声,再与原伴奏回混。

纯人声模式不会启动伴奏分离,原功能与音质参数保持不变。

尚未选择音频文件。

3. 调节声音与音调匹配0

默认保持原调;跨音域时逐步调节。

分析原声声区并匹配角色。手动调整优先;变调会改变歌曲调性。

低沉(-12) 原声(0) 清脆(+12)

当前为 0 半音:先保留输入的自然音高;需要跨音域时再试听小幅调整。

高级参数

稳定模式已启用:默认固定检索与辅音保护;可选连续声区保护,变调补偿默认关闭。没有索引的角色不使用检索。

0.30

越高音色越贴近角色,但会增加颗粒风险。建议 0.20–0.40。

0.25

数值越低,清辅音与呼吸保护越强;0.5 会关闭保护。高动态输入建议 0.20–0.30。

0%

云端 RVC:高音更积极调整检索与辅音保护,低音保持温和;0 保持固定参数,不改旋律。

0%

可选:最多 ±2 半音连续补偿,会改变部分音程;默认 0 保留原始旋律。

音高提取算法

云端可选;设备端固定使用 RMVPE。自动模式会在结果中显示实际算法。

输出格式

智能格式(手机 MP3 · 电脑 WAV)

输出采样率

跟随角色模型(40 / 48 kHz)

0.5

0 更贴近原唱音量,1 保留模型原始动态;云端与设备端含义一致。

人声与伴奏独立混音

MIX / STEMS

人声与伴奏独立混音

先设置比例再变声;结果生成后可点“更新混音”,无需重新分离或变声。

0 dB
0 dB

调整后点击更新混音,预听与下载会同步更新。短期分轨最多保留约 2 小时。

正在就绪变声引擎;此检查不会上传音频。