支持 MP3、M4A、WAV、FLAC、OGG 和 Opus。全部在浏览器中解码,不会上传。
关于音频合并
把音频文件接在一起听起来应该很简单,接的这一步确实简单。真正出问题的是它周围的一切:某一段的音量只有下一段的一半;文件的采样率不同,于是后面几段播放速度不对;每个接缝处还会有一声明显的「咔哒」。
这个工具把这些都处理掉。添加文件、排好顺序,就能拿回一个文件——响度已统一,采样率已正确协调,还可以选择加淡入淡出让接缝干净利落。
解码和混合全部在你的浏览器里完成。没有任何音频被上传,而这正是处理访谈、录音和未发行音乐时最要紧的一点。
使用方法
- 添加音频文件——可以一次选多个,也可以之后再添加
- 用箭头排好顺序,把不需要的移除
- 选择如何处理音量——统一响度、按峰值归一化,或保持原样
- 可按需设置段落之间的间隔和每个接缝处的淡变
- 点击合并成一个文件,然后下载结果
每一段都会显示时长和实测电平(dB),以及即将对它应用的调整量。也就是说,你能在工具动手之前看清它要做什么。
三种音量选项
结果听起来是否舒服,就由这个设置决定。
- 统一各段之间的响度——默认选项,通常也是你想要的。每一段按 RMS 测量,也就是信号的平均能量,它与人耳实际听到的响度最为吻合。随后把每一段都提升到最响那一段的水平,于是是小声的段落被抬上来,而不是把其余全部压下去
- 按峰值分别归一化——把每段中最响的那一个采样点对齐到你设定的目标值。结果可预测,但它解决不了听感响度:整段都很轻,却有一声杂音正好顶到满刻度,按峰值归一化之后它依然很轻
- 保持原有音量——不施加任何增益,直接相接。如果这些文件本来就是一起做过母带的,这才是正确选择
无论选哪一种,成品文件最后都会检查一次,若有任何地方超过满刻度就整体下调,因此结果不会削波。
采样率与声道
音频文件自带采样率:CD 音质为 44,100 Hz,视频用 48,000 Hz,语音录音有时是 22,050 Hz。采样率不同的文件不能直接串接,否则后面的会以错误的速度和音高播放。
这里所有内容都通过一个离线音频上下文、以你这批文件中最高的采样率渲染,属于正确重采样,而不是把采样点重新解释一遍。单声道与立体声混用也是同样的道理:只要有一个文件是立体声,结果就是立体声,单声道文件会被放到左右两个声道。
间隔与淡变
- 间隔在各段之间插入静音。适合有声书分章或区隔不同的录制片段;如果是连续的音乐,保持 0 即可
- 淡变在每个段落边界加上短促的淡入和淡出。哪怕只有十分之一秒,也足以消除一段波形在周期中途结束、下一段又从别处开始时产生的「咔哒」声
人们用它来做什么
- 把分次录制的访谈或播客片段接起来
- 为没有播放列表功能的播放器,把有声书章节合成一个文件
- 把多条语音备忘串成一段完整录音
- 用多首曲子做出连续不断的混音
- 统一用不同设备录制的素材之间的音量
- 把因录音笔文件大小限制而被切开的课堂录音接回去
值得一提
- 可在 Windows、macOS、Linux 和 ChromeOS 的任何现代浏览器中使用;与文件夹类工具不同,它接收的是文件而非文件夹,所以手机和平板上也能用
- 不上传任何内容。解码、合并和编码全部在页面内完成
- 输出为 WAV——未经压缩,因此自合并那一刻起就是无损的,但体积较大,立体声大约每分钟 10 MB。如果需要 MP3,把结果再送进音频转换器
- 只要浏览器能播放的都能合并:MP3、M4A/AAC、WAV、FLAC、OGG 和 Opus。无法解码的文件会连同文件名一起报告,而不会被悄悄跳过
- 很长的合并会按总时长成比例占用内存,因为整个结果要先组装好再写出。一小时立体声大约占 600 MB 内存
- 电平以 dBFS 显示,0 为最大值。常见的音轨大致在 −20 到 −12 dB RMS 之间
相关工具
- 音频转换器 — 把合并后的 WAV 转成 MP3 或 M4A
- 音频剪辑 — 合并之前先把各段裁好
- 音频转文字 — 把做好的录音转成文字
- 视频转音频(MP4转MP3) — 先从视频里提取声音