# AI 人声分离使用教程：三步提取人声与伴奏

> 来源：工具派（https://gjupai.com） 原文页面：https://gjupai.com/tutorial/ai-vocal-remover-guide

## 工具简介

AI 人声分离是工具派推出的免费在线音轨分离工具，基于本地 Spleeter ONNX 模型，可以把一首歌曲拆分成独立的人声轨和伴奏轨，还支持 4 轨分离（人声、鼓、贝斯、其他）以及最多 3 个文件的批量 ZIP 分离。

最大的亮点是隐私安全：整个分离过程都在你自己的浏览器里完成，音频文件不会上传到任何服务器。首次使用需要加载约 51MB 的模型文件，加载完成后会自动缓存，之后再用就很快了。

![AI 人声分离：三步完成音轨分离](/api/file/download?path=article/202607/1783878494687_3401.png)

## 第一步：选择分离模式

工具顶部提供三种模式，按需选择：

- 2 轨分离：最常用的模式，输出人声 + 伴奏两条音轨，适合提取清唱或制作伴奏带；
- 4 轨分离：输出人声、鼓、贝斯、其他四条音轨，适合音乐制作、混音学习；
- 批量分离 ZIP：一次最多上传 3 个音频文件，分离结果打包成 ZIP 下载，适合批量处理。

模式切换是即时生效的，不需要刷新页面。

## 第二步：上传音频并确认

![上传成功：先试听原始音频](/api/file/download?path=article/202607/1783878560744_8698.png)

点击上传区域或直接把音频文件拖拽进去即可，支持 MP3、WAV 等常见音频格式（audio/*），单个文件最大 50MB。官方建议上传 5 分钟以内、带人声的歌曲，分离效果最好。

上传成功后页面会出现原始音频播放器和波形/频谱图，建议先试听确认文件没有传错，再点击「开始 2 轨分离」按钮。首次分离会加载模型，进度条会显示百分比，耐心等待即可；实测加载完成后 5 秒的测试音频几十秒内就分离完成。

## 参数说明

| 参数 | 类型 | 可选值 | 说明 |
| --- | --- | --- | --- |
| 分离模式 | 单选 | 2 轨分离 / 4 轨分离 / 批量分离 ZIP | 决定输出的音轨数量和下载形式 |
| 上传歌曲 | 文件选择器 | audio/*，最大 50MB | 支持拖拽、粘贴或点击上传，建议 5 分钟以内带人声的歌曲 |
| 批量文件数 | 限制 | 最多 3 个 | 仅批量模式，结果打包为 ZIP |
| 音量 | 滑块 | 0-100% | 结果页每条音轨可独立调节试听音量，不影响导出文件 |
| 下载格式 | 按钮 | WAV / MP3 | 人声、伴奏、混音均支持两种格式 |

## 第三步：试听并下载分离结果

![分离完成：人声与伴奏独立下载](/api/file/download?path=article/202607/1783878604812_7858.png)

分离完成后，页面会并排展示人声轨和伴奏轨，每条音轨都有独立的播放器和音量滑块，可以单独试听。页面底部还有「混音试听」，把人声和伴奏重新混合，方便对比分离前后的效果。

每条音轨都提供 WAV 和 MP3 两种下载格式：WAV 是无损格式，适合二次编辑；MP3 体积小，适合直接分享。实测下载的人声 MP3 文件可以正常播放，人声提取干净，伴奏中只剩背景音乐。

小技巧：如果模型分离效果不理想，工具会自动回退到立体声中心声道抵消方案，保证一定有结果输出。

## 常见问题

**1. 音频会上传到服务器吗？**

不会。整个分离过程都在浏览器本地完成，音频文件不会离开你的电脑，可以放心处理未发布的原创作品或涉密录音。

**2. 为什么第一次分离特别慢？**

首次使用需要下载并加载约 51MB 的 Spleeter 模型，加载进度会显示百分比。模型加载后会缓存在浏览器里，之后再分离就很快了。

**3. 分离出来的人声有杂音怎么办？**

人声分离的效果与歌曲本身有关：人声清晰、伴奏不复杂的歌曲效果最好。建议选择 5 分钟以内、人声突出的音频；4 轨模式可以进一步把鼓和贝斯拆出来，减少伴奏残留。

**4. 支持批量处理吗？**

支持。切换到「批量分离 ZIP」模式，一次最多上传 3 个音频文件，分离结果会打包成一个 ZIP 文件下载，每个音频对应独立的输出。

## 总结与相关工具

AI 人声分离把专业的音轨分离能力搬到了浏览器里：本地处理保护隐私、2 轨/4 轨/批量三种模式覆盖大部分场景、WAV/MP3 双格式导出。无论是做卡拉 OK 伴奏、提取清唱素材，还是音乐学习，都能免费快速搞定。

立即体验：[AI 人声分离](/tools/ai_vocal_remover)

相关工具推荐：分离出的人声可以用 [音频转文字](/tools/audio_to_text) 生成文稿；多段音频可以用 [音频合并](/tools/audio_merger) 拼接；不确定音频内容可以先用 [AI 音频分类器](/tools/ai_audio_classifier) 识别类别。

