
做翻唱、混剪、口播整理时,经常会遇到一个需求:我只想要人声,或者只想要伴奏,能不能把两条声音分开?现在比较常见的做法是使用 AI 人声分离。它和传统的“左右声道分离”不一样,不要求原音频本身就把人声和伴奏放在不同声道,而是通过模型识别音乐中的不同成分,再分别输出。
常见场景包括:
如果原始音频里人声和乐器重叠非常严重,或者混响很重,输出仍可能存在少量残留。

1、打开转换猫APP,找到人声分离功能,如果想要伴奏,主界面选择【提取歌曲的伴奏】;如果想要人声,主界面选择【提取歌曲的人声】。

2、从手机本地勾选音频,支持从本地音乐、外部分享导入、名称检索等方式勾选音频。

3、进入参数界面,可以滑动开关提取伴奏/提取人声,确认后点击开始转换执行人声分离任务。人声伴奏分离成功后,进入预览页可以试听一下分离效果,保存音频到手机本地。

方法二:转换猫网页版分离人声与伴奏
1、打开转换猫官网,找到顶部工具栏找到在线工具。选择界面上的人声分离功能。

2、勾选或者拖拽上传到区域内,上传后自动核对文件信息。

3、文件解析完成后默认是提取【只提取伴奏】,可以切换到【只提取人声】。确认后点击开始提取。

4、人声与伴奏分离完成后,保存音频到电脑文件夹内。

想把人声和伴奏分开,比较稳的思路不是“找神奇按钮”,而是先把原素材整理好。
如果是视频,先提取音频;如果格式特殊,先转成 MP3/WAV;只需要一段就先裁剪。之后再进行 AI 人声分离,最后试听并做少量后期。
前处理做好,通常比盲目换多个分离工具更能提升最终效果。