免费 AI 去除背景音乐 — 只保留人声
从任意歌曲、翻唱、直播或录音中提取人声,把音乐留下。录音室级三模型 ensemble 将人声从伴奏中分离,让你下载无损 WAV 或 FLAC 的干净人声 —— 可以上传文件,也可以直接用链接。
如何去除背景音乐 — 4 步
- 上传音频或粘贴 YouTube / SoundCloud / TikTok 链接。
- 选择 WAV 或 FLAC。如果你打算编辑或再利用,无损格式能让人声保持自然。
- 点击分离。Studio 流程运行三个基于 transformer 的模型,并对它们的掩码取平均,从而把人声从音乐中分离。
- 下载
vocalsstem —— 那就是去除背景音乐后的人声。(如果你只想要音乐,instrumentalstem 也在那里。)
什么能把人声从音乐中干净地分离
要出色地去除背景音乐意味着三件事:人声保持自然(没有机械感或水下般的失真)、音乐真正离开(没有鼓声或旋律从人声下面透出),以及不丢失重要内容(气声、辅音和音色完好)。旧的“音乐消除器”用相位技巧,把这三点全毁了。
像 BS-Roformer 这样的现代 AI 模型学习人声在频谱图中的样子,只保留那一部分,把其余当作音乐丢弃。我们的 ensemble 融合三款顶尖模型,因此没有哪一款模型的弱点 —— 一个漏出镲片,另一个糊掉人声 —— 会出现在你的结果里。
谁在去除背景音乐
🎬 视频创作者
从片段中隔离人声,让你放入自己的音乐,或清理一段自带了不想要的音乐垫的音轨。
🎙️ 播客与配音
从烘焙进音乐垫的录音中还原干净人声,随时可以重新混音或重新配字幕。
🎤 翻唱与人声再利用
从歌曲或翻唱中获取纯人声,用于研究、重新对时,或叠加到新的编曲上。
🈶 配音与语言工作
在转写、翻译或重新配音之前,把口播或演唱的人声从音乐中剥离出来。
📞 采访与讲座
从嘈杂、充满音乐的录音中提取人声,让内容清晰、易于配字幕。
🎧 采样与混音
制作人获取干净人声,用来切片、变调,并重新编排成新的作品。
为什么我们的音乐去除比其他免费工具更好
- 三模型 ensemble 对比单一模型。多数免费工具只运行一个较旧的模型,要么让音乐从人声下面透出,要么让人声听起来单薄。对三个 transformer 模型取平均能让人声干净而饱满。
- 两边都给你。一次运行同时给出纯人声 stem 和纯音乐 stem,你需要哪个都行。
- 无损 WAV / FLAC。许多免费工具只导出 MP3,会让人声变柔糊。我们给你可供编辑的全质量 stem。
- 直接用链接。粘贴 YouTube、SoundCloud 或 TikTok 链接 —— 无需单独的下载步骤。
- 私密并自动删除。文件在我们自己的 GPU 上运行,并在 24 小时内删除。
常见问题
哪个下载文件是没有音乐的人声?
vocals stem。它是去除背景音乐后隔离出的人声。instrumental stem 则相反 —— 去除人声后的音乐。
它适用于播客或口播视频吗?
它在音乐之上有清晰人声时效果最好(歌曲、翻唱、直播、配音)。带音乐垫的口播内容通常也能清理得很好,但非常微弱或经过重度处理的音乐垫可能留下轻微残留 —— 模型是针对音乐之上的人声调优的,而非任意降噪。
我可以改为保留音乐、去除人声吗?
可以 —— 从同一次运行中下载 instrumental stem。这一用途请见伴奏提取器。
文件可以多长、多大?
每个文件最长 20 分钟,最大 100 MB。一首普通歌曲约 6 分钟完成。
它会改变人声或添加效果吗?
不会 —— 它只做分离。人声保持自然音色;输出经过响度归一化,但不做其他处理。
免费额度:几个文件?
登录后每月免费 3 首(无需账户可免费试用 1 首),或通过 Patreon Pro 或按量计费积分获得更多。