PCM文件格式简介(比较专业)

12 篇文章 0 订阅
PCM文件:模拟音频信号经模数转换(A/D变换)直接形成的二进制序列,该文件没有附加的文件头和文件结束标志。Windows的Convert工具可以把PCM音频格式的文件转换成Microsoft的WAV格式的文件。   
脉冲编码调制PCM文件格式简介


          将音频数字化,其实就是将声音数字化。最常见的方式是透过脉冲编码调制PCM(Pulse Code Modulation) 。运作原理如下。首先我们考虑声音经过麦克风,转换成一连串电压变化的信号,如图一所示。这张图的横座标为秒,纵座标为电压大小。要将这样的信号转为 PCM 格式的方法,是使用三个参数来表示声音,它们是:声道数采样位数采样频率

         采样频率即取样频率,指每秒钟取得声音样本的次数。采样频率越高,声音的质量也就越好,声音的还原也就越真实,但同时它占的资源比较多。由于人耳的分辨率很有限,太高的频率并不能分辨出来。在16位声卡中有22KHz、44KHz等几级,其中,22KHz相当于普通FM广播的音质,44KHz已相当于CD音质了,目前的常用采样频率都不超过48KHz。

        采样位数即采样值或取样值(就是将采样样本幅度量化)。它是用来衡量声音波动变化的一个参数,也可以说是声卡的分辨率。它的数值越大,分辨率也就越高,所发出声音的能力越强。
 
         声道数很好理解,有单声道和立体声之分,单声道的声音只能使用一个喇叭发声(有的也处理成两个喇叭输出同一个声道的声音),立体声的pcm可以使两个喇叭都发声(一般左右声道有分工) ,更能感受到空间效果。
声波曲线1 声波曲线2 声波曲线3
  下面再用图解来看看采样位数和采样频率的概念。让我们来看看这几幅图。图中的黑色曲线表示的是pcm文件录制的自然界的声波,红色曲线表示的是pcm文件输出的声波,横坐标便是采样频率;纵坐标便是采样位数。这几幅图中的格子从左到右,逐渐加密,先是加大横坐标的密度,然后加大纵坐标的密度。显然,当横坐标的单位越小即两个采样时刻的间隔越小,则越有利于保持原始声音的真实情况,换句话说,采样的频率越大则音质越有保证;同理,当纵坐标的单位越小则越有利于音质的提高,即采样的位数越大越好。

          在计算机中采样位数一般有8位和16位之分,但有一点请大家注意,8位不是说把纵坐标分成8份,而是分成2的8次方即256份; 同理16位是把纵坐标分成2的16次方65536份; 而采样频率一般有11025HZ(11KHz),22050HZ(22KHz)、44100Hz(44KHz)三种。

样点
t1
t2
t3
t4
t5
t6
t7
...
t16
t17
t18
t19
t20
幅值
0011
0101
0111
1001
1011
1101
1110
...
0110
0110
0101
0011
0000


          那么,现在我们就可以得到pcm文件所占容量的公式:
     存储量=(采样频率*采样位数*声道)*时间/8(单位:字节数)

  例如,数字激光唱盘(CD-DA,红皮书标准)的标准采样频率为44.lkHz,采样数位为16位,立体声(2声道),可以几乎无失真地播出频率高达22kHz的声音,这也是人类所能听到的最高频率声音。激光唱盘一分钟音乐需要的存储量为:     
     (44.1*1000*l6*2)*60/8=10,584,000(字节)=10.584MBytes
这个数值就是pcm声音文件在硬盘中所占磁盘空间的存储量。

  计算机音频文件的格式决定了其声音的品质,日常生活中电话、收音机等均为模拟音频信号,即不存在采样频率和采样位数的概念,我们可以这样比较一下:
          44KHz,16BIT的声音称作:CD音质;
          22KHz、16Bit的声音效果近似于立体声(FM Stereo)广播,称作:广播音质;
          11kHz、8Bit的声音,称作:电话音质。
          微软的WAV文件就是pcm编码的一种。

 
  • 0
    点赞
  • 14
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
### 回答1: PCM是脉冲编码调制的缩写,是一种音频文件格式。在音乐录制中,PCM格式常用于无损音频的存储和传输。它以每秒钟的采样次数和每个采样点的位深度来描述音频信号的参数。 PCM格式的音乐录制首先需要进行采样,即将连续的模拟声音信号转换为离散的数字信号。通过麦克风等设备,将声音转换为电信号,然后进行采样。采样的频率表示每秒钟采集声音信号的次数,常见的采样频率有44.1 kHz和48 kHz。采样频率越高,音频信号的还原度越高,但文件的大小也会相应增加。 每个采样点的位深度决定了该采样点能够表示的音量级别,位深度越高,音量级别的区分度就越高。常见的位深度有16位和24位。位深度的增加会增加音频文件的动态范围,使得录制的音频更加清晰、逼真。 在PCM格式的音乐录制中,由于是无损压缩的方式,录制下来的音频质量非常高。然而,由于PCM格式没有进行压缩,所以文件的大小往往较大,占用存储空间较多。为了减小文件的大小,常常需要进行其他格式的编码和压缩。常见的PCM格式音乐文件后缀有.wav、.aiff等。 总结来说,PCM格式的音乐录制通过采样频率和位深度来描述音频信号的参数,具有高保真和无损压缩的特点。虽然文件大小较大,但是录制的音质非常好,适用于对音质要求较高的场合。 ### 回答2: PCM是脉冲编码调制的缩写,是一种无损音频格式,常用于音乐录制和存储PCM录制音乐的过程是通过模拟-数字转换器将模拟音频信号转换为数字音频信号,然后将数字音频信号编码为PCM格式进行存储PCM格式的音乐录制具有高保真性,即录制和播放的音频信号非常接近原始音频信号,没有明显的失真或压缩。这使得PCM成为专业音乐录制和制作中常用的格式之一。 PCM格式的音频文件通常具有较大的文件大小,因为它是无损压缩的。一般而言,PCM格式的音乐录制质量更高,更适合专业音乐制作和后期处理。它能够保留较多的细节和动态范围,使得录制出的音乐更加真实和逼真。 然而,由于PCM格式的文件大小较大,占用存储空间较多,因此在实际应用中,为了减小文件大小,常常会将PCM格式进行压缩。常见的音频压缩格式有MP3、AAC等,它们将PCM格式的音频数据进行压缩编码,以减小文件大小,但会引入一定程度的失真。 总之,PCM格式是音乐录制中常用的一种无损音频格式,具有高保真性,适合专业音乐制作和后期处理。然而,由于文件大小较大,常常需要进行压缩以节省存储空间。 ### 回答3: PCM是Pulse Code Modulation的缩写,意为脉冲编码调制。它是一种数字音频编码格式,用于音乐录制和存储PCM格式音乐录制是一种无损编码方式,可以准确地记录和传输声音。 PCM格式音乐录制的基本原理是通过在一定时间间隔内对声音信号进行采样,将采样值按照一定规则进行编码和记录。具体来说,以CD音质为例,PCM音频被以16位深度和44.1kHz的采样率进行录制。这意味着每个声音样本使用16个比特位来表示,每秒钟需要采样并记录44100次声音样本。 PCM格式音乐录制的优点之一是高保真度。它可以准确地记录原始音频信号,因此在播放时能够还原出与录制时几乎一样的声音质量。此外,PCM格式音乐录制还具有较低的延迟和可靠的数据完整性。 对于使用PCM格式的音乐录制,需要使用特定的音频设备和工具。录制时,音频设备将声音信号转换成PCM编码,并通过存储介质(如磁带、硬盘或光盘)保存起来。在播放时,音频设备将PCM编码转换回模拟声音信号,然后通过扬声器或耳机播放。 除了PCM格式,还有其他许多音频编码格式,如MP3、AAC等。这些格式通过使用不同的压缩算法,可以在减小文件大小的同时保持较高的音质。但是,与PCM格式相比,它们会丢失一些音质细节。 总而言之,PCM格式音乐录制是一种高保真度的数字音频编码方式,能够准确地记录和传输原始声音信号。它在成品制作和专业录音等领域得到广泛应用。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值