声音进入计算机以后,不再以空气振动的形式存在,而是转换为可以存储、传输和处理的数字数据。采样率、位深度和声道是数字音频中最基础的三个参数:采样率决定声音在时间上的记录密度,位深度决定振幅记录的精细程度,声道则决定不同音频信号的组织方式。

理解这几个概念,有助于在 Adobe Audition 中正确设置录音参数、判断文件质量,并理解不同音频格式之间的差异。

一、声音数字化的基本过程

1、从声压到数字数据

自然界中的声音是一种连续变化的声压波。

话筒接收到空气中的压力变化后,会将其转换为连续变化的模拟电信号。音频接口中的模数转换器(Analog-to-Digital Converter,ADC)随后对这个模拟信号进行测量,并将其转换为计算机能够处理的数字数据。

这个过程包含两个关键步骤:

采样(Sampling):按照固定时间间隔记录信号变化

量化(Quantization):将连续的振幅转换为有限数量的数字等级

经过采样和量化后的数据,就是数字音频(Digital Audio)。

数字音频并不是直接保存空气振动本身,而是保存对模拟信号的离散测量结果。

打开网易新闻 查看精彩图片

图 1:声音从声压到数字采样值的转换

2、数字音频的两个基本维度

数字音频主要描述两个维度:

• 时间

• 振幅

采样点在时间轴上的位置表示声音变化发生的时刻,采样值大小表示该时刻的振幅。

因此,数字音频可以理解为:在时间轴上按照固定间隔记录声音振幅变化。

播放数字音频时,数模转换器(Digital-to-Analog Converter,DAC)会根据这些采样值生成连续变化的模拟信号,再由扬声器转换为空气中的声波。

如果采样满足相关条件,并经过适当重建滤波,数字系统可以较准确地恢复原模拟信号中的有效频率成分。

3、录音与播放的信号路径

声音从现实环境进入 Audition,大致经过以下过程:

(1)话筒将声压变化转换为模拟电信号。

(2)音频接口对模拟信号进行滤波、采样和量化。

(3)驱动程序将数字数据传递给 Audition。

(4)Audition 将数据写入音频文件或多轨会话。

(5)播放时,音频接口将数字信号转换回模拟信号,并发送到监听设备。

这一过程说明:录音阶段产生的问题,通常无法通过后期软件完全修复。

例如:

• 话筒本身失真

• 前置放大器过载

• 模数转换器削波

这些问题发生在数字数据形成之前,因此软件中的高精度处理无法重新生成已经丢失的信息。

二、采样率与频率范围

1、采样率与采样间隔

采样率(Sample Rate)表示每秒采集声音样本的次数,单位为赫兹(Hertz,Hz)。

例如,48 kHz 的采样率表示每秒采样 48 000 次。

采样率决定数字系统在时间上的分辨能力。

采样率越高:

• 相邻采样点之间的时间间隔越短

• 单位时间内记录的数据越多

• 理论上能够表示的最高频率上限越高

打开网易新闻 查看精彩图片

图 2:相同时间范围内不同采样率的取样密度

采样间隔与采样率之间的关系为:

采样间隔 = 1 ÷ 采样率

例如,48 kHz 采样率对应的采样间隔约为:

1 ÷ 48 000 秒

也就是约 20.8 微秒。

2、奈奎斯特频率与最高输入频率

声音信号通常包含多个频率成分,其中最高频率记为 fₘₐₓ。

为了避免采样过程中产生混叠,需要满足奈奎斯特—香农采样定理(Nyquist–Shannon Sampling Theorem):

fₛ > 2fₘₐₓ

其中:

• fₛ 表示采样率

• fₘₐₓ 表示输入信号中的最高频率

采样率的一半称为奈奎斯特频率(Nyquist Frequency):

fₙ = fₛ ÷ 2

因此:

fₘₐₓ < fₙ

这表示:奈奎斯特频率不是输入声音的频率,而是当前数字系统能够表示的最高理论频率上限。输入信号中的最高频率必须低于奈奎斯特频率,才能避免混叠。

例如,在 48 kHz 采样率下:

fₙ = 48 000 ÷ 2 = 24 000 Hz

理论上可以表示 24 kHz 以下的声音频率成分。

如果输入信号包含超过 24 kHz 的频率成分,这些成分可能会折回到较低频段,形成混叠(Aliasing)。

混叠一旦写入数字音频,通常很难通过后期处理完全分离。

因此,模数转换器会在采样前使用抗混叠滤波器(Anti-aliasing Filter),提前衰减超过目标范围的高频信号。

3、常见采样率选择

44.1 kHz 和 48 kHz 是数字音频中最常见的采样率。

44.1 kHz 常用于音乐发行,因为它能够覆盖人耳主要听觉范围,并长期作为音乐格式标准。

48 kHz 更常用于视频、影视和广播制作,因为它与视频工程中的时间标准更加匹配。

88.2 kHz、96 kHz 等更高采样率会增加文件大小和处理负担,通常用于特殊需求,例如高频测量、大幅度变速变调处理或明确要求的专业制作环境。

实际项目中,应根据最终交付标准确定采样率,并保持录音、编辑和导出阶段的一致。

三、位深度与振幅记录精度

1、量化等级与位深度

位深度(Bit Depth)表示每个采样值使用多少二进制位保存。

采样决定在什么时候测量声音。

位深度决定振幅量化的精细程度。

位深度越高,可表示的量化等级越多,振幅变化越细腻。

例如,16 位音频可表示 2¹⁶ = 65 536 个等级。

24 位音频则可表示 2²⁴ = 16 777 216 个等级。

因此,24 位音频能够比 16 位音频提供更细的振幅表示能力。

2、动态范围与量化误差

量化等级越多,相邻等级之间的差距越小,量化误差(Quantization Error)越低。

对于理想整数 PCM 系统,每增加 1 位,理论动态范围约增加 6 dB。

因此:

• 16 位音频理论动态范围约为 96 dB

• 24 位音频理论动态范围约为 144 dB

实际设备的动态范围还受到话筒噪声、前置放大器噪声和模数转换器性能等因素影响,因此实际可用动态范围通常低于理论值。

3、dBFS 与数字满刻度

数字音频通常使用 dBFS(Decibels Relative to Full Scale,满刻度分贝)表示电平。

与模拟设备不同,数字系统存在明确上限:0 dBFS 表示数字满刻度;超过 0 dBFS 的整数音频数据会发生削波(Clipping)。

削波会导致波形顶部被截断,产生明显失真。

因此,录音时通常不会让峰值长期接近 0 dBFS,而会保留一定安全余量(Headroom)。

4、录音余量与位深度选择

较高位深度的重要意义之一,是在较低录音电平下仍能保持更好的量化精度,从而便于保留更大的录音余量。

采用 24 位录音时,即使录音峰值没有接近满刻度,较弱信号仍能保持足够精度。

这使录音者可以降低输入增益压力,为突发峰值留下空间,减少过载风险。

因此,现代录音通常采用 24 位作为常见工作标准,而不是追求让信号尽可能接近 0 dBFS。

四、整数音频与浮点处理

1、整数 PCM 音频

常见 WAV 文件通常采用 PCM(Pulse-Code Modulation,脉冲编码调制)格式。

整数 PCM 通常使用固定范围表示采样值,例如:

• 16 位整数

• 24 位整数

其特点是:

• 数值范围固定

• 超出可表示范围时,会在数字存储或输出阶段产生截断

2、32 位浮点处理

32 位浮点(32-bit Floating Point)采用浮点数表示音频数据。

与整数格式相比,它可以在数字处理阶段保存更大的数值范围。

在 Audition 中,混音、增益调整和效果处理等操作,都可能产生超过 0 dBFS 的中间结果。

如果这些数据仍处于浮点处理链中,并未经过截断或限制处理,后续降低增益时通常可以保留这些信息。

3、浮点处理的边界

浮点处理只能保护数字运算阶段的数据。

如果声音在进入 Audition 之前已经发生:

• 模拟过载

• ADC 削波

• 录音失真

那么原始信息已经丢失。

将文件转换为 32 位浮点,并不能恢复已经损坏的波形。

同样,提高已有音频文件的位深度,也不会增加原始录音中不存在的信息。

五、声道与音频信号组织

打开网易新闻 查看精彩图片

图 3:单声道、立体声、双单声道与多声道

1、声道与声源

声道(Channel)表示音频文件中可以独立存储和处理的一路信号。

声道数量与现实中的声源数量并不完全相同。

例如:

一支话筒可以录制多人对话,但文件可能只有一个声道。

两支话筒也可以同时录制同一个声音,并形成两个独立声道。

因此,声道描述的是数据组织方式,而不是简单表示声音来源数量。

2、单声道

单声道(Mono)包含一路音频信号。它常用于:

• 旁白

• 播客

• 人声录音

• 单支话筒拾音

单声道记录的是一个完整音频信号,不包含左右空间差异。

3、立体声

立体声(Stereo)包含左右两个独立声道。

左右声道之间的:

• 电平差

• 到达时间差

• 相位差

共同形成空间感和方向感。

立体声适用于:

• 立体声话筒

• 音乐混音

• 环境录音

4、双单声道

双单声道(Dual Mono)表示左右两个声道分别保存单独的单声道信号,而立体声指的是左右声道共同表现一个声源的空间信息。

如果只是将同一路单声道复制到左右声道:

• 听感通常位于中央

• 不会产生真正立体声效果

• 文件数据量增加

双单声道通常表示两个彼此独立的单声道信号。例如,采访录音中可以将采访者和被采访者分别记录在左、右声道。此时两个声道并不是为了形成空间感,而是分别保存不同来源的声音。

5、多声道

多声道(Multichannel)用于包含多个独立音频通道的文件,例如:

• 环绕声

• 沉浸式音频

• 多路录音系统

多声道制作需要关注:

• 声道顺序

• 扬声器布局

• 输出规范

Adobe Audition 可以处理多声道音频,并在波形编辑器中对独立声道进行查看和编辑。

小结

数字音频通过采样和量化记录声音。采样率决定可表示的频率范围,位深度影响振幅精度和动态范围,声道组织独立音频信号。理解这些参数,有助于在 Audition 中正确选择录音、编辑和导出设置。

Adobe 官方参考:

• 数字化音频

https://helpx.adobe.com/audition/desktop/digital-audio-fundamentals/digitizing-audio.html

• 多声道音频工作流程

https://helpx.adobe.com/audition/desktop/importing-recording-and-playing/multichannel-audio-workflow.html

点赞有美意,赞赏是鼓励