「这个视频里的背景音乐叫什么,我想单独存下来。」
刷到一段特别好的配乐、录了一节两小时的课想只留声音、想把语音留言转成音频文件 —— 都是同一件事:把视频的声音抽出来。
这篇讲清楚怎么抽 + MP3 / M4A / WAV 该选哪个 + 抽出来能不能变清楚。
一、原理:声音本来就是单独一条轨
视频文件里,画面和声音是分开存的两条轨道:
video.mp4
├── 视频轨 H.264 编码的画面
└── 音频轨 AAC 编码的声音
所谓「提取音频」,就是把音频轨单独拿出来另存。
这件事有个重要含义:不需要重新编码,也就不会损失音质。
二、三种格式,用途完全不同
用 提取音频 时会让你选格式:
| 格式 | 编码 | 体积 | 什么时候用 |
|---|---|---|---|
| M4A | AAC | 小 | 首选。多数视频的音频本来就是 AAC,导出等于直接搬运,音质零损失 |
| MP3 | MP3 | 小 | 兼容性最好。老设备、车载音响、某些播放器只认 MP3 |
| WAV | 无压缩 | 很大 | 要拿去做后期处理(降噪、剪辑、混音)时用 |
为什么 M4A 是首选
绝大多数 MP4 视频的音频轨就是 AAC 编码。
- 导出 M4A = 把 AAC 数据原样搬进 M4A 盒子 → 零损失
- 导出 MP3 = AAC 解码再用 MP3 重新编码 → 二次有损
MP3 是上世纪的格式,同码率下音质不如 AAC。除非对方设备只认 MP3,否则没必要转。
WAV 什么时候值得
WAV 不压缩,1 分钟音频约 10MB。
只有一种情况值得:你要拿去做进一步处理。降噪、变速、混音这些操作在有损格式上会累积失真,用 WAV 当中间格式更稳。
存档和日常听,用 WAV 纯属浪费空间。
三、几种典型用法
用法 1 · 扒背景音乐
刷到好听的配乐,提取成 M4A 存下来。
注意:提取出来的是混音后的成品,包含视频里所有的声音 —— 人声、音效、环境音都在里面。想只要纯音乐,提取解决不了,那是另一回事。
用法 2 · 网课 / 讲座录音
两小时的课程视频,画面就是一张 PPT,留着占几个 G。
提取成 M4A,体积能小到原来的二三十分之一,通勤时当播客听。
用法 3 · 会议记录转文字
很多语音转文字的工具只收音频文件。先提取成 M4A 或 WAV 再喂进去。
用法 4 · 给视频换配乐
想把 A 视频的音乐配到 B 视频上:
四、4 个翻车点
翻车点 1 · 以为提取能让音质变好
不能。 提取只是把已有的数据搬出来。
视频里的声音本来就闷、有杂音、录得远,提取出来一模一样。音质的天花板在录制那一刻就定死了。
翻车点 2 · 全都转 MP3
看到「视频转 MP3」这个说法就默认要转 MP3。
实际上多数情况 M4A 更好 —— 同样小,音质无损。只有对方设备明确只认 MP3 时才转。
翻车点 3 · 想「只提取人声」或「只提取伴奏」
这是人声分离,跟提取音频是两码事。
提取音频拿到的是混音后的成品,人声和伴奏早就混在一起了,普通的提取工具分不开。
翻车点 4 · 忽略版权
从别人的视频里扒音乐自己听没问题,用到你自己发布的作品里就是另一回事了。
平台的版权识别现在很灵,轻则限流重则下架。商用场景一定要用有授权的音乐。
五、提取完,视频那边怎么办
提取音频不会改动原视频,原文件还在。
如果你的目的是「留声音、扔画面」,提取完直接删原视频就行。
如果是「视频要留但不要声音」,那是 视频静音 的活。
一句话总结
视频里的画面和声音本来就是两条轨,提取 = 把音频轨单独存出来,不重新编码所以零损失。格式优先选 M4A(多数视频的音频本来就是 AAC,直接搬运);只有对方设备老才转 MP3;要做后期处理才用 WAV。提取不能让音质变好 —— 天花板在录制时就定了。
立即试试:
相关阅读: