重叠人声分离最简单三个步骤
步骤1:先去除歌曲中的背景音乐
首先打开AIFooler,上传需要处理的目标音频。进入人声分离功能后,先使用默认分离模型,将歌曲中的BGM与人声进行拆分。

处理完成后,不需要保留伴奏文件,只需导出其中的纯人声音频,作为后续处理素材。
【这一步主要是把复杂的音乐背景去掉,让后续模型可以更加集中地处理两个人重叠的人声。】

步骤2:根据场景选择重叠人声模型
将上一步提取出来的纯人声文件再次上传到AIFooler。接下来需要根据音频类型选择对应的分离模型。
如果是两个人同时说话,例如采访、访谈或双人对话,可以选择【重叠说话人声分离】或【男女对话】模型,用于进行双人男女声拆分。

如果是两个人同时唱歌,而且其中一人的声音相对较小,可以根据实际情况选择【和声/非和声】进行二次拆分。

步骤3:试听单人音轨并进行降噪
选择模型后开始处理,等待系统完成音频分析和分离。处理完成后,可以分别试听生成的单人音轨,检查两个人的声音是否已经按照预期拆分。

如果音频本身比较干净,可以直接保存分离结果。如果试听时发现存在明显底噪、环境杂音等问题,可以继续使用AIFooler的一键音频降噪功能进行处理。

使用小贴士
原始录音质量很重要。录音越清晰,人物声音之间的区别越明显,后续处理通常也更容易。如果原始音频本身存在严重噪声、失真或声音过小,可能会影响最终分离效果。
根据音频类型选择模型。两人同时讲话时,优先考虑【重叠说话人声分离】或【男女对话】模型;
两人唱歌且存在和声交织时,可以尝试和声模型。不同场景应选择对应的处理方式。
导出格式按用途选择。如果后续还要进行剪辑、混音等处理,可以优先选择质量较高的音频格式;用于日常试听或分享时,MP3等常见格式更加方便。
按照“去除BGM—二次选择模型—试听并降噪”的流程,就可以使用AIFooler处理两人以内的重叠人声,适用于男女对话人声分离、双人对话以及合唱和声等场景。











