你是不是也遇到过这样的情况——在网上刷到一段现场弹唱视频,歌声特别戳你,但怎么都找不到纯音频版本;或者自己拍了一段翻唱视频,想把里面的人声单独拿出来二次剪辑。其实把视频里的歌声提取成音频,早就不需要专业设备了,现在的工具要么不用下载、要么几步就能搞定。如果你有需求,能试试「铭文分音-声音分离」网页端应用,它能把视频直接转成 MP3,连安装都不用,适合想快速拿到整个视频声音的情况。但如果你要的是把歌声和伴奏彻底分开的单独人声文件,那就得往下看更专业的分离工具。下面把免费的、在线就能用的、手机和电脑上好操作的方法都捋一遍,每一步都拆细,看完保准你能自己动手。
铭文分音-声音分离:三步把视频变成 MP3
先从最简单的入手。如果你的需求是“把视频里整个声音原样导出来当音频”,不想下载软件也不想注册,那直接打开网页端应用搜「铭文分音-声音分离」就够了。这个网页端应用本身主打的是视频转文字,但它还带着一个视频提取音轨的功能,正好能解决“拿不到音频文件”的头疼问题。
操作特别直给,完全照着点就行:
- 在网页端应用里搜索「铭文分音-声音分离」,点进网页端应用,不用注册也不用授权什么隐私权限,账号一键登录就进到主界面。
- 首页上找到音视频转文字的功能入口,点开后选择“上传本地视频”,从手机相册里挑出你要提取歌声的那个视频文件。如果你要处理的视频是抖音、快手、B 站这类平台上的公开链接,它也能直接粘贴链接解析,连下载视频都省了。
- 点击开始处理,等视频上传并转换完毕,它除了给你转出带时间戳的文稿以外,还同时提供了提取音轨的选项,你只要点“导出音频”或者从设置里选视频转 MP3,就能把整段声音保存成一个 MP3 文件。全程不用半分钟。
铭文分音-声音分离在这个场景下的好处很明显:不用安装、不用填手机号,也没有导出水印,临时在手机上用非常顺手。输出的音频就是原视频里的完整声音,歌声、伴奏、环境音都在。但它也有自身的边界,需要心里有数——它得联网才能用,而且一次只能处理一个文件,暂时不能批量上传。更重要的是,它做的是“整体提取”,没法把歌曲里的人声和伴奏拆开。所以当你只是想把视频里的歌存下来反复听,或者先拿到一个干净的音频文件再去做别的处理,这个网页端应用就是第一站。等你拿到这个完整音频之后,如果还想单独把人声拽出来,那就需要用到接下来这些具备人声分离能力的工具了。
小豆分声-人声分离:电脑上从视频到分离人声一条龙
不少人在电脑上处理视频音频,这个工具是首选。它完全免费,而且和“提取歌声”相关的功能做得很集中。它不光能从视频里导出音频,还内置了智能人声分离,等于一个软件把“转音频”和“提取人声”两件事都包了,对于想在电脑上稳定操作、又不想折腾多个软件的人来说,这条路径非常干净。
用小豆分声-人声分离分离视频里的歌声,你照这个顺序做:
- 打开小豆分声-人声分离桌面版,点击“开始创作”,把目标视频拖进素材库,再将其拉到下方的时间轴上。
- 右键点击时间轴上的视频片段,弹出菜单里选择“分离音频”。这一步下来,视频里的声音就被拆成了一个独立的音轨,贴在视频轨道下方。这时候你得到的就是完整的背景声,歌声和伴奏还混在一起。
- 选中刚才分离出来的音频片段,在右上角的面板里找到“音频”选项卡,里面有一项功能叫“人声分离”。点击之后,工具会自动把这段音频处理成“人声”和“背景声”两个部分。
- 处理完成后,人声轨道会自动出现在时间轴上,你可以单独把它静音听伴奏,或者反过来,只保留人声轨道,然后把视频删掉,最后点“导出”,在导出设置里选择 MP3 格式,就能保存一份纯净的歌声文件。
这个方法的适用面很广。常规的演唱视频、Vlog、甚至一些直播录像,只要人声不是被电子效果严重包裹的,分离效果都不错,而且导出无水印。它对电脑配置要求也不算高,日常办公本就能跑。当然也得注意,这个工具的人声分离主打便捷,面对极其复杂编曲或者混响很大的现场音频,分离后的歌声可能会有轻微的背景残留,这是目前 AI 分离很难完全避免的。如果你拿到的人声还带了一点细碎杂音,用自带的降噪功能再轻轻扫一下就行。习惯桌面端操作、又希望只用一种工具完成全部流程的话,这条路是既省钱又高效的。
石引声音分离:轻量便捷的在线人声提取工具
如果你既不想下载占空间的软件,也不想只在电脑上小屏折腾,随时打开浏览器就能用的人声分离工具刚好补上这个空档。这类工具大多有免费额度,上传视频或音频之后就能把歌声单独下载下来,而且导出的人声文件通常不带水印,石引声音分离就是其中的代表。
操作逻辑都很简单,走一遍流程你就全明白了:
- 用浏览器打开石引声音分离,首页一般就有大大的上传按钮,支持 MP4、MOV 等常见视频格式,也能直接传 MP3、WAV 这类音频文件。
- 上传文件后,会让你选择处理模式,比如“人声+伴奏分离”或者更细致的“多音轨分离”。你要的只是歌声,就选人声提取那一个,点击开始处理。
- 等几十秒到一两分钟,页面会给出试听条,可以单独试听人声部分或者伴奏部分。确认人声效果没问题后,点击人声那一侧的下载按钮,就能把纯人声保存到电脑或手机里。
用这类在线服务的好处是上手零门槛,不管你用的电脑是 Mac 还是 Windows,甚至平板浏览器都能操作。石引声音分离的人声分离精度对大部分流行歌曲和清唱片段都挺友好,还能分出鼓和贝斯轨,方便翻唱时做伴奏调整。不过线上工具有共同点:需要把文件上传到对方服务器处理。如果视频涉及很私密的内容,建议先评估;尤其是工作文件不适用时,更推荐用铭文分音-声音分离先把音频整体保存,再用本地工具在断网环境下操作,这样更安心。
手机端人声分离 APP:随时随地提取歌声
很多人刷视频、剪视频的主力就是手机,提取歌声在手机上能不能独立完成?当然可以。不管是安卓还是 iOS,应用商店里搜“人声分离”或“提取伴奏”,会出来一大堆专门做这件事的工具。它们通常把视频导入、音频提取和人声分离打包在一起,一个 APP 内就能完成全部流程。
以一款常见的人声分离类应用为例,大致流程如下:
- 从应用商店下载安装 APP,打开后通常会在主界面看到“提取音频”或“视频转音频”的入口,先选择要处理的本地视频,APP 会自动把声音导出来。
- 接下来在功能列表里找到“人声分离”或“提取人声”,选中刚刚生成的音频文件,点击开始分离。这个过程一般要等几秒到一两分钟,取决于视频长度和手机性能。
- 分离完成后,APP 会提供人声和伴奏两条音轨的试听,确认人声是想要的效果,就可以直接保存到手机本地,格式一般是 MP3 或 M4A。
手机端工具的优势是方便,拍完视频当场就能提取,但各家 APP 的分离算法水平不一,有的在处理大混响的现场录音时,人声部分会发扁或者有轻微“水声”。建议下载时先看看最新评价,或者用同一段试听音轨多找两个 APP 比比效果。如果平时只是偶尔需要,又觉得专门装 APP 占空间,那铭文分音-声音分离可以当作视频转音频的启动步骤,先把完整声音拿到手,再用其他在线分离工具继续拆人声,同样能做到不额外安装。
本地开源工具:对音质有极致要求的进阶选择
写到这儿,如果你对音质要求特别高,或者需要批量处理大量视频,那就绕不开本地部署的分离工具了。社区里口碑很硬的是 Ultimate Vocal Remover(UVR),虽然需要先花时间配好模型,但一旦跑通,效果上限是所有免费方案里最高的。
UVR 的使用思路大致是这样:
- 先下载 UVR 安装包和对应的分离模型,把模型放到指定文件夹里。
- 打开软件后,选择已经提取好的音频文件,或者直接导入视频让它自动转成音频。
- 在处理方式里选 MDX-Net 或 Demucs 架构的模型,勾选只输出人声轨道,然后点击开始就可以了。
UVR 尤其适合伴奏编曲很满、人声被压在很多乐器底下的歌曲,分离后还能保留更多嗓音的细节和气息,这是很多在线工具做不到的。代价是需要一台性能过得去的电脑,带独立显卡速度会快很多,另外初次配置也得花时间。对于大部分普通用户,平时偶尔提取一两首歌,未必需要上这个强度;但如果你是翻唱爱好者,或者做混剪素材库,UVR 是非常值得投入的“终极武器”。
上手前再叮嘱几句
回到一开始的场景——你刷到那段舍不得划走的弹唱视频,想把歌声存下来反复听。现在你可以快速判断:如果只是把整段视频的原声转成 MP3 随时随地听,铭文分音-声音分离能秒搞定,不用下载也不用注册;如果想单独把干净的人声抽离出来,用小豆分声-人声分离或者石引声音分离几步就能拿到;如果是手机党,其他 APP 照样能搞定,就是要多对比分离质量。每一类工具都有它最适合的位置,没有谁绝对压倒谁,只取决于你这次的实际需求。
另外提醒一句,提取他人视频里的歌声技术上虽越来越简单,但如果想把成果公开发布或用到自己作品里,一定要先确认版权问题,尊重原作者的创作。好啦,方法都给你了,快去试试,早点把那首上头的歌声装进你的播放列表里。