EchoraEchora
返回博客
人声分离

如何去除歌曲人声,制作卡拉 OK 伴奏

•
阅读约 16 分钟

想跟着喜欢的歌曲唱歌,又不想听到原唱同时响起?你不一定非要找到官方伴奏。借助 AI 音频分离,可以从已有歌曲中去除人声,得到适合练唱、排练或卡拉 OK 的伴奏版本。

基本流程很简单:上传混合好的歌曲,将人声与音乐分开,试听伴奏,检查是否有不需要的人声残留或音频伪影,确认结果可用后再下载。

重点不仅是去掉歌声。好的结果还应尽量保留原曲的音乐编排,让鼓、贝斯、吉他、钢琴、合成器及其他伴奏元素听起来仍然自然,避免明显的空洞感、失真或音质损伤。

本文会介绍如何在线去除歌曲人声、伴奏结果是如何得到的、哪些因素会影响分离质量,以及在用于卡拉 OK 前应该怎样检查。

去除歌曲人声的概念示意图:将混合音频分离为人声和伴奏两条音轨

概念示意:一首混合歌曲分成人声与伴奏两部分,制作练唱伴奏时使用的是伴奏结果。

去除歌曲人声是怎样一个过程?

使用人声分离处理歌曲时,通常希望得到两种结果之一:单独的人声音轨,或降低人声后保留下来的伴奏音轨。

对卡拉 OK 和练唱而言,第二种结果才是重点。

制作完成的歌曲通常是一个混合后的音频文件。主唱、和声、鼓、贝斯、吉他、键盘、效果声和其他音乐元素都已混在一起。除非你已经拥有录音室原始音轨,否则无法通过一个简单的静音按钮,只把歌手的声音完美去掉。

AI 人声分离器采用不同的方法:分析最终混音,估算哪些内容属于人声,哪些属于伴奏。Echora 的人声分离器会根据一个上传文件生成两条可同步播放的结果:人声(Vocals)和伴奏(Instrumental)。

这些说法听起来像不同的处理过程,实际上强调的是同一次两轨分离的不同目标。人声去除关注减少原始混音中的人声,伴奏提取则关注在人声减少后保留音乐伴奏。

如果想把歌曲变成伴奏,又不想从头重做编曲,这类伴奏制作工具就能派上用场。这里所说的制作伴奏,是通过分离已有录音中的人声与音乐,得到它的伴奏版本。

分离完成后,可以把两条输出理解为同一录音中相互关联的两个部分:

  • **人声:**从混音中估算出的人声部分
  • **伴奏:**降低人声后估算出的音乐伴奏部分

如果你的目标是卡拉 OK、练唱、排练,或减少主唱干扰、专注聆听编曲,通常需要下载的是伴奏文件。

同时也要理解它的能力边界。分离得到的伴奏并不等同于录音室原始多轨素材。AI 是从最终混音中估算分轨,不能原样恢复录音工程、数字音频工作站(DAW)项目、MIDI 数据或未经处理的母带。

什么样的歌曲音源更适合去除人声?

源文件的质量会明显影响最终伴奏的可用程度。

Echora 建议从手里最清晰的音源开始。人声分离器目前支持 MP3、WAV、M4A、AAC 和 FLAC 文件,文件大小上限为 50 MB,时长上限为 30 分钟。

清晰的音源能为分离提供更多可用信息。在条件允许时,选择你有权处理的、质量最高的歌曲版本。经历多次格式转换或较重压缩的音源,可能带有额外的处理伪影,让人声与乐器之间的边界更难判断。

这并不意味着每次分离都必须使用录音室母带。实际选择时,可以遵循一个简单原则:尽量使用手里最清晰的版本,避免选择压缩严重的副本。

反复转换可能引入原始录音中没有的变化。较强的压缩、削波、失真及其他处理,都会成为 AI 需要分析的信号的一部分。

声音复杂的音源仍可能得到可用伴奏,但需要在处理后更仔细地检查。对于人声混响较重、和声叠加较多、带有人声失真效果或乐器编排十分密集的歌曲,尤其应该试听后再决定是否使用。

人声与乐器并没有完全独立的频率范围。歌声可能与吉他、钢琴、合成器、镲片等声音共享频段,背景和声也可能与主唱重叠。混响和延迟还会让人声能量扩散到混音中,使系统更难准确判断哪些声音属于歌手。

因此,完整流程不应止于“上传后直接下载”。在将结果作为卡拉 OK 伴奏使用之前,先认真试听。

如何使用 AI 去除歌曲中的人声

与手动调整均衡器、尝试从混音中削弱人声相比,使用在线人声去除工具的流程更简单。

下面以 Echora 的人声分离器为例说明。

第 1 步:选择你有权处理的歌曲

从你拥有或已获授权处理的音频文件开始。

去除录音中的人声,并不会自动改变相关歌曲的版权状态。将受版权保护的录音制作成伴奏,也不会让你取得词曲或录音的所有权;公开或商业使用处理后的音频,仍可能需要相应许可。

无论是个人排练还是其他已获授权的用途,都应从你有权处理的音源开始。

第 2 步:将歌曲上传到 Echora

打开人声分离器,上传音频文件。

人声分离器支持 MP3、WAV、M4A、AAC 和 FLAC,文件大小不超过 50 MB,时长不超过 30 分钟。上传一个源音频文件即可生成两条分离结果。

处理前,确认选中的正是你想使用的歌曲版本。如果同时有压缩较重的副本和更清晰的音源,通常应优先选择后者。

第 3 步:开始分离人声与伴奏

提交音频,让 AI 分析混音。

系统会估算其中的人声与伴奏部分,生成两条可同步播放的结果,无需你手动识别人声频率或叠加多种滤波处理。

这里进行的是分离,不是重新生成音乐。目标是估算歌曲中原本存在的伴奏部分,而不是创作一套替代编曲。

处理时间可能随音频长度和当前服务负载而变化。

第 4 步:试听人声与伴奏结果

处理完成后,先不要直接下载伴奏并认定它已经可以使用。

先试听两条输出。

同步混音播放器支持同时播放人声和伴奏,也可以单独静音其中一条、分别调节音量、在波形中定位播放位置,并比较歌曲的不同段落。

这一步很有用,因为歌曲各个部分的分离效果可能不同。主歌听起来可能很干净,但副歌因为有更多和声、混响或乐器叠加,可能出现明显的人声残留。

Echora 去除歌曲人声的示例结果,展示人声与伴奏波形、静音、音量调节和独立下载按钮

Echora 公开示例播放器:可以同步或单独试听人声与伴奏,调节音量,并分别下载。

第 5 步:下载前检查伴奏

接下来,把注意力放在卡拉 OK 最需要的结果上:伴奏。

主要检查以下四点。

1. 人声残留

是否还能听见歌词、呼吸声、和声或原始歌声的片段?

在较安静的段落,或主旋律停下之后,少量残留可能更明显。

2. 混响与人声效果

即使主要歌声已经减弱,人声混响、延迟或其他效果仍可能留在伴奏中,有时听起来像音乐背后的微弱回声。

3. 乐器是否受损

留意鼓、贝斯、吉他、钢琴和合成器等重要音乐元素。如果去除人声后,某些乐器变得单薄、带有金属感、模糊或异常发闷,应在使用前确认这些变化是否可以接受。

4. 整体音乐平衡

最实用的伴奏,不一定是人声残留绝对最少的那一份。它也需要保留自然、完整的音乐伴奏。

有时,带有少量人声串音的结果,反而比伴奏因较强的分离处理而明显受损的结果更实用。

第 6 步:下载伴奏音轨

完整试听并确认符合用途后,下载伴奏音轨。如果找不到官方伴奏,又想取得歌曲的伴奏版本,这就是最后一步:保留分离出的伴奏,下载后用于你有权进行的用途。

如果你还需要单独使用人声,也可以保留分离后的人声结果。

应当把试听当作流程的一部分,而不是可有可无的附加步骤。

如何判断伴奏音轨的质量

没有一种听音测试适用于所有歌曲,但按一定顺序检查会更有效。

先听主唱最明显的部分,再检查编曲发生变化的段落:

  • 人声较突出的主歌
  • 编曲饱满的副歌
  • 和声段落
  • 即兴唱句
  • 持续长音
  • 较安静的过渡部分

主唱被削弱后,背景和声有时会更容易被注意到,以微弱唱句或声音纹理的形式留在伴奏中。

检查完人声,再把注意力转向伴奏。先听鼓和贝斯的节奏律动,然后关注吉他、钢琴、键盘及其他旋律乐器的细节。

可以问自己一个实际的问题:

听起来是否仍像原来那首歌,只是歌手的声音被去掉了?

这通常比只盯着“最后一点人声是否完全消失”更有助于判断结果。

以原曲作为参照。先播放原曲中的一小段,再听伴奏中的对应位置,来回比较,而不只是单独听伴奏。

这样更容易发现细微变化。例如,单听吉他可能觉得正常,但与原始混音直接比较,就可能发现它明显变薄了。

如何将伴奏音轨用于卡拉 OK

得到可用的伴奏后,最直接的用途就是跟着它唱歌。

伴奏为练唱留出了空间,减少原唱的干扰。你可以用它练习:

  • 音准
  • 节奏
  • 乐句处理
  • 气息控制
  • 段落之间的衔接
  • 对整体编曲的熟悉程度

少了原唱的声音,你更容易听清自己的演唱,也更容易判断是否跟得上歌曲。

伴奏还适合演出前的排练。你可以从有权处理的歌曲中准备伴奏,用来练习演出的段落安排,而不必一直等待官方伴奏发布。

当你已经熟悉歌曲,但需要跟着原有编曲反复练习时,这种方式尤其有用。

如果目标只是制作卡拉 OK 风格的伴奏,需要的就是分离后的伴奏输出。

请记住,人声去除工具提供的是音频伴奏。它不会自动添加同步歌词,也不会将文件制作成完整的卡拉 OK 视频。Echora 的人声分离器提供用于卡拉 OK 和练唱的伴奏音频,不负责生成歌词或视频。

明确这一点有助于安排后续步骤:人声去除解决的是音频分离问题,歌词、画面同步和视频制作需要另外处理。

去除人声能彻底消掉歌手的声音吗?

不一定。

AI 分离会根据最终混音估算人声和伴奏,因此不同录音的结果会有差异。

有些歌曲可以得到只有少量残留、相当实用的伴奏,另一些则可能保留明显的人声痕迹,尤其是在录音包含以下情况时:

  • 较重的人声混响
  • 多层和声
  • 较强的人声效果
  • 密集的乐器编排
  • 人声与乐器频率明显重叠

伴奏本身也可能发生听感变化。

因此,不应把人声去除理解为:每首歌都能变成完全干净、达到录音室品质的伴奏。人声音轨中可能残留音乐,伴奏中也可能残留人声,AI 分离无法重建录音室原始分轨。

可以把这个过程理解为估算最终混音中的人声与伴奏两部分,而不是从源录音中直接取回已经不再独立存在的制作文件。

人声提取、人声去除和音轨分离有什么区别?

这些概念相互关联,但关注的输出结果不同。

人声提取适合希望单独听清或处理混音中人声的情况。分离结果可以用于演唱练习、分析、编辑,或涉及独立人声的创作。

人声去除强调另一种结果:在减少人声的同时保留伴奏。如果你的目标是去除歌曲人声,制作卡拉 OK 或其他伴奏,就应关注这个结果。

Echora 的人声分离器会同时提供这两种结果,因此一次分离就能获得人声和伴奏。

音轨分离则超出了简单的人声与伴奏两轨拆分。如果你想单独得到鼓、贝斯、吉他、钢琴等声部,多轨分离会更合适。Echora 的音轨分离器就是为这种更细的分离需求设计的。

选择哪种流程,主要取决于你需要哪些输出,而不是哪个名称听起来更高级。

去除歌曲人声时的常见误区

使用低质量源文件

较差的音源会在处理开始前,就限制结果的质量。

尤其是手里有多个版本时,尽量选择最清晰的一份。

期待得到完美的录音室伴奏

从最终混音中去除人声,并不等同于直接获得录音室原始伴奏母带。

结果中可能仍有声音重叠、残留或处理伪影。合理的预期可以帮助你根据实际可用程度判断,而不是要求结果在每个细节上都绝对完美。

跳过试听

处理后立即下载,可能会让你忽略仔细聆听才能发现的问题。

在正式使用前,检查副歌、和声、过渡以及其他复杂段落。

混淆人声去除与降噪

人声去除工具与音频降噪工具处理的问题不同。

如果录音中有风声、嘶声、嗡鸣或室内噪声,降低这些声音属于降噪;从制作完成的歌曲中去掉歌手的声音,则属于声源分离。

这两种流程不能直接互相替代。

如何获得更干净的伴奏音轨

一些简单习惯可以让整个流程更可靠。

使用手里质量最好的音源。 输入质量会影响分离器能够利用的信息。

避免反复重新压缩的副本。 经过多次下载和格式转换的版本,可能包含额外的处理伪影。

试听复杂段落。 不要只根据简单的主歌判断整首歌。还应检查副歌、和声、混响较重和乐器较密集的部分。

与原曲对照。 直接比较更容易发现人声和乐器的变化。

根据实际用途判断结果。 一条音轨即使不够干净、达不到专业制作的要求,也可能足以用于日常练唱。

不要期待每首歌都有相同的分离效果。 不同的编曲、人声风格、效果和混音方式,会带来不同的分离难点。

常见问题

任何歌曲都可以去除人声吗?

你可以尝试对音频录音进行人声分离,但结果会因音源而异。更清晰的录音和较简单的混音通常更有利于分离;密集的编曲、混响和声音重叠则可能增加难度。

如何获得一首歌曲的伴奏?

对于你有权处理的歌曲,可以使用 AI 人声去除或人声分离工具,把最终混音分成人声和伴奏。如果目标是保留音乐、减少歌手的声音,需要的就是伴奏输出。

AI 能完全去除歌曲中的人声吗?

不一定。伴奏中可能残留部分人声,分离过程也可能影响一些音乐信息。AI 是根据最终混音估算不同组成部分,并不能直接恢复录音室原始音轨。

去除人声时,乐器声音也会被去掉吗?

目标是在减少人声的同时保留伴奏,但分离并不总是完美。某些乐器与人声频率重叠时,可能一并受到影响,因此需要试听伴奏并与原曲比较。

分离后的伴奏可以用于卡拉 OK 吗?

可以。伴奏结果可用于卡拉 OK、练唱和排练。人声去除工具生成的是音频伴奏,不会自动添加同步歌词或制作卡拉 OK 视频。

去除人声时应该使用什么质量的音频?

使用手里最清晰、质量最高的音源,尽量避免反复压缩过的版本。Echora 的人声分离器支持 MP3、WAV、M4A、AAC 和 FLAC 文件,文件大小上限为 50 MB,时长上限为 30 分钟。

人声去除工具与音轨分离器一样吗?

不完全一样。人声去除侧重于减少人声、保留伴奏;更全面的音轨分离器则可以拆分出鼓、贝斯、吉他、钢琴等不同声部。

使用 Echora 为歌曲制作伴奏

找不到官方伴奏时,你不一定需要从头重做整首歌。

使用 Echora 的人声分离器,可以从已获授权的音频文件开始,将混音录音分离成人声和伴奏,同步试听两条结果,再下载所需的版本。

实际操作流程如下:

  1. 上传歌曲。
  2. 开始分离人声与伴奏。
  3. 试听两条结果。
  4. 检查复杂段落中的人声残留和音频伪影。
  5. 确认伴奏符合用途后下载。

对练唱而言,这可以把已有歌曲变成实用的排练素材;对卡拉 OK 准备而言,它可以提供减少原唱干扰的伴奏音频。

将人声去除理解为一种分离处理过程,有助于保持合理预期。选择合适的音源,仔细试听,与原曲对照,再根据实际用途决定伴奏是否可用。

试用 Echora 人声分离器