STEM(音轨分离)GRAB(快速获取)打开工具 →

从任何歌曲中去除人声: 免费

提供完整音质的伴奏。无需注册账户,也不需要为每首歌曲付费。与付费版本使用相同的模型和 192 kbps(或无损 WAV)格式——支持时长不超过 15 分钟的曲目。

这是在不购买软件或寻找精简版文件的情况下,从歌曲中去除人声的最快方法:上传一首曲子,即可获得纯伴奏版本。 (卡拉 OK 版本),以及单独的人声部分。 一次性完成。采用 GPU 进行真正的音轨分离,无需注册、无需水印、没有每日限制。 您上传的文件会在分离完成后立即删除。想要 WAV 格式、伴奏版本或更长的曲目吗? 功能完整的工具位于主页上。

Your upload is deleted the moment the split is finished. Want WAV, play-along mixes or longer tracks? The full tool is on the home page.

现在即可移除人声 →

本工具的功能介绍

人声去除功能是本网站使用最多的功能:在过去 40 天的测试期间,共有 1776 次上传,超过了其他所有功能的总和。从文件本身来看——全站范围内,我们统计了 320 个文件的尺寸——平均大小为 9.44 MB,最大为 83.66 MB;大多数文件的大小介于 4 到 8 MB(107 个),8 到 16 MB(57 个)以及 2 到 4 MB(43 个)。其中 98% 的文件都在我们的限制范围内,并没有超出。这个范围与正常的三到五分钟 MP3 文件在日常导出质量下的尺寸相符——这并不是什么问题,只是一个平均上传文件的尺寸。真正的问题在于,导致上传失败的原因往往不是人声去除本身,而是其他原因:全站最常见的上传失败原因是文件没有扩展名,在 40 天内出现了 26 次——通常是文档或重命名的文件被拖放到指定区域,而不是我们不支持的文件格式。如果您的上传被拒绝,那么更有可能是由于这些原因,而不是人声去除功能本身的问题。

一首歌曲是如何被拆解的

StemGrab 在我们的 GPU 上运行一个专门用于分离人声的模型。它不是采用旧的相位抵消技巧(这种方法只能在某些立体声音轨上实现一半的效果),而是真正理解了人声的声音,并将其从音轨中提取出来,从而为您提供纯音乐和人声两种独立的 MP3 文件,以及鼓、贝斯、吉他、钢琴和其他乐器。 人声文件,所有这些都以单独的 MP3 格式呈现,同时还有鼓、贝斯、吉他、钢琴等其他部分。

AI 分离与旧的相位抵消技巧

您在网上找到的大多数免费“人声去除”工具仍然基于 相位反转原理:翻转一个立体声通道的极性,并将其与其他通道相加,这样所有位于正中心的音轨都会被消除。这是一种有趣的技巧,但它实际上并不是真正的人声去除:它会同时消除鼓和贝斯以及人声,并且只能在完全居中的音轨上工作,对于单声道文件或带有立体声混响的人声则完全无效。最终结果是一个空洞、相位失真的音轨,其中人声只是部分被移除,而不是真正地分离出纯音乐。

StemGrab 不会消除任何内容。该模型经过训练,可以识别人声的实际声音(其共振峰、呼吸和语调),并直接将人声从音轨中提取出来,无论音轨是单声道还是立体声,居中还是偏向一侧,干燥还是带有混响。这就是为什么一次上传可以为您提供真正干净的人声文件 以及真正干净的纯音乐文件,而不是一种妥协方案。想了解其背后的原理吗?我们撰写了一篇关于 AI 乐器分离实际工作原理的文章,包含相位处理技巧。

全音轨混音人声 + 伴奏乐器人声提取人声器乐伴奏剩余部分一次上传 → 获取纯人声和卡拉 OK 版本
一步到位的人声去除:模型将人声从混音中分离出来,为您提供独立的纯人声版本以及干净的器乐伴奏。

一次上传即可获得

如果您计划发布您的作品(混音、串烧或伴奏版),请阅读以下内容: 您可以合法地对结果进行哪些操作? 首先,私下练习和实验总是没问题的;但如果要发布他人的录音,通常需要获得许可。

如果您想从视频而不是歌曲中提取音乐——例如,一段带有背景音乐的 Vlog 或教程? 直接将视频上传到这里。 并保留人声部分作为您的旁白。

在哪些情况下,去除人声仍然存在困难?

没有一种分离模型是完美的,在您责怪上传之前,最好先了解哪些歌曲会给模型带来挑战。 多层和声伴唱 对于模型来说,这些仍然被认为是人声,因此它们也会从混音中移除,包括主唱:如果想要保留的副歌部分由三个人声组成,那么您的纯音乐版本在歌曲应该展开的部分会突然显得空洞。 较长的混响尾音 是第二个问题。虽然人声本身是干燥的,但录音时所处的房间也是录音的一部分,因此,在一首充满大厅混响效果的曲目中,即使人声已经移除,您仍然可以在纯音乐版本中听到微弱的人声残留。

声音编码器、人声效果器以及大幅度调整音调的人声。 这些处理方式听起来更像是乐器,而不是人声,而对于现代流行歌曲而言,这通常不是一个好的选择:可以预见的是,这些处理过的部分会保留在伴奏中。 现场录音 是最难处理的,因为观众、场地以及不同麦克风之间的声音串扰都会叠加在一起。而且,对于大约1970年之前的录音,整支乐队经常会被压缩成一个狭窄的单声道混音,因此模型可供使用的空间信息也更少。

这并不意味着处理后的结果无法使用。这意味着你应该在最终确定之前先听一下:一段密集的现场录音可能需要降低人声部分的音量,而不是完全移除,而这正是混音器的作用所在。

在下载之前检查伴奏部分。

StemGrab不会简单地提供一个“已移除人声”的文件,然后希望一切顺利。当处理完成后,你会在结果页面上获得一个小型的混音器,其中包含所有七个分离的音频通道,这样你就可以: 单独播放 伴奏部分,单独聆听;或者 静音 只静音人声通道,然后聆听乐队演奏你真正关心的部分。这是发现上述问题最快的方法:跳到副歌部分,静音人声,你会在十秒钟内知道和声是否也一并被移除。

如果听起来不错,就使用 下载选定的音频通道 并只下载你需要的部分,而不是整个压缩包。如果听起来不好,现在你就知道原因了,并且可以判断歌曲的其他部分是否效果更好。StemGrab还会读取 乐曲的调性和速度 将上传的音频与伴奏分离,并将人声部分单独显示出来。如果您打算在伴奏上进行演唱或演奏,而不是仅仅听歌,这一点就非常重要。您是否希望将人声旋律以音符的形式呈现,而不仅仅是标注调? MP3 转换为 MIDI 将上传的音频转换为 MIDI 文件,并将人声部分单独放在一个音轨中。

其他事项

这真的是完全免费的吗,没有任何附加条件?

是的,网站上的广告可以维持服务器运行。无需注册账户、提供电子邮件地址或添加水印,也没有试用期限制。

分离效果如何?

在大多数现代且混音良好的音轨中,分离效果非常出色。对于音轨过于密集、现场录制或带有大量混响的音频,分离难度会增加:这适用于所有分离工具。

我的文件会被处理吗?

处理完毕后立即删除;人声部分将在 45 分钟内清除。请参阅 隐私政策.

我可以发布卡拉 OK 版本吗?

该工具可免费使用,但歌曲的版权仍归原作者所有:如果需要公开发布,请事先获得许可。