【实验六】MPEG音频编码

【实验六】MPEG音频编码

一、实验要求

◼ 输出音频的采样率和目标码率
◼ 选择三个不同特性的音频文件
噪声(持续噪声、突发噪声)
音乐
混合
◼ 某个数据帧,输出
该帧所分配的比特数
该帧的比例因子
该帧的比特分配结果

二、实验原理

1、流程图在这里插入图片描述
根据图片,编码器由两大主线,上面一条“滤波器组——块形成——线性量化器——颗粒形成”是编码的主线,下面一条是音频编码的特点,它根据人耳听觉的特点(心理声学模型),对于上面量化比特数作出了限定。

2、人耳听觉特性:
(1)等响度曲线:
在这里插入图片描述
横坐标是波长,纵坐标是声强级。由于声强的测量比较容易实现,通过声强的测量也可以间接求得质点速度等其它物理量,所以声学中常用这个物理量来描述声波。声强级以符号SIL表示。

图中每条曲线所对应的不同波长的声强级是不相同的,但人耳感觉到的响度却是一样,每条曲线上注有一个数字,单位是响度方。由等响曲线族可以得知,当响度较小时,人耳对长短波(高低音)感觉略微下降,而响度较大时,对各个波长声音的感知区别不大。

(2)频域掩蔽:在这里插入图片描述
一个强纯音会掩蔽在其附近同时发声的弱纯音,这种特性称为频域掩蔽,也称同时掩蔽(simultaneous masking)

声音频率在300 Hz附近、声强约为60 dB的声音掩蔽了声音频率在150 Hz附近、声强约为40 db的声音。又如,一个声强为60 dB、频率为1000 Hz的纯音,另外还有一个1100 Hz的纯音,前者比后者高18 dB,在这种情况下我们的耳朵就只能听到那个1000 Hz的强音。如果有一个1000 Hz的纯音和一个声强比它低18 dB的2000 Hz的纯音,那么我们的耳朵将会同时听到这两个声音。要想让2000 Hz的纯音也听不到,则需要把它降到比1000 Hz的纯音低45 dB。一般来说,弱纯音离强纯音越近就越容易被掩蔽。

实际上由于我们日常声音的成分复杂,频域掩蔽会加大我们分析声音的难度。

3、MPEG-I 标准定义了两个模型
◼心理声学模型1:计算复杂度低,但对假设用户听不到的部分压缩太严重
◼ 心理声学模型2 :提供了适合Layer III编码的更多特征

三、实验结果

main函数

int main(int argc, char** argv) {
 typedef double SBS[2][3][SCALE_BLOCK][SBLIMIT];
 SBS* sb_sample;
 typedef double JSBS[3][SCALE_BLOCK][SBLIMIT];
 JSBS* j_sample;
 typedef double IN[2][HAN_SIZE];
 IN* win_que;
 typedef unsigned int SUB[2][3][SCALE_BLOCK][SBLIMIT];
 SUB* subband;
 
 frame_info frame; // 包含头信息、比特分配表、声道数、子带数等内容
 frame_header header; // 包含采样频率等信息
 char original_file_name[MAX_NAME_SIZE]; // 输入文件名
 char encoded_file_name[MAX_NAME_SIZE]; // 输出文件名
 short** win_buf;
 static short buffer[2][1152];
 static unsigned int bit_alloc[2][SBLIMIT]; // 存放双声道各个子带的比特分配表
 static unsigned int scfsi[2][SBLIMIT];
 static unsigned int scalar[2][3][SBLIMIT]; // 存放双声道3组12个样值的各个子带的比例因子
 static unsigned int j_scale[3][SBLIMIT];
 static double smr[2][SBLIMIT], lgmin[2][SBLIMIT], max_sc[2][SBLIMIT];
 // FLOAT snr32[32];
 short sam[2][1344];  /* was [1056]; */
 int model;
 int nch; // 声道数
 int error_protection;
 static unsigned int crc;
 int sb, ch;
 int adb; // 比特预算 (i.e., number of bits available)
 unsigned long frameBits, sentBits = 0;
 unsigned long num_samples;
 int lg_frame;
 int i;

/* Used to keep the SNR values for the fast/quick psy models */
static FLOAT smrdef[2][32];

static int psycount = 0;
extern int minimum;

time_t start_time, end_time;
int total_time;


 sb_sample = (SBS*)mem_alloc(sizeof(SBS), "sb_sample");
 j_sample = (JSBS*)mem_alloc(sizeof(JSBS), "j_sample");
 win_que = (IN*)mem_alloc(sizeof(IN), "Win_que");
 subband = (SUB*)mem_alloc(sizeof(SUB), "subband");
 win_buf = (short**)mem_alloc(sizeof(short*) * 2, "win_buf");

 /* clear buffers */
 memset((char*)buffer, 0, sizeof(buffer));
 memset((char*)bit_alloc, 0, sizeof(bit_alloc));
 memset((char*)scalar, 0, sizeof(scalar));
 memset((char*)j_scale, 0, sizeof(j_scale));
 memset((char*)scfsi, 0, sizeof(scfsi));
 memset((char*)smr, 0, sizeof(smr));
 memset((char*)lgmin, 0, sizeof(lgmin));
 memset((char*)max_sc, 0, sizeof(max_sc));
 //memset ((char *) snr32, 0, sizeof (snr32));
 memset((char*)sam, 0, sizeof(sam));

global_init();

 header.extension = 0;
 frame.header = &header;
 frame.tab_num = -1;  /* no table loaded */
 frame.alloc = NULL;
 header.version = MPEG_AUDIO_ID; /* Default: MPEG-1 */
 
 total_time = 0;
 
 time(&start_time);
 programName = argv[0];    // exe文件名称
 if (argc == 1)  /* no command-line args */
  short_usage();
 else
  parse_args(argc, argv, &frame, &model, &num_samples, original_file_name, encoded_file_name); // 解析命令行参数
 print_config(&frame, &model, original_file_name, encoded_file_name); // print文件参数到窗口
 
 /* this will load the alloc tables and do some other stuff */
 hdr_to_frps(&frame);
 nch = frame.nch;
 error_protection = header.error_protection;

 /* 从数据流获取音频 */
 while (get_audio(musicin, buffer, num_samples, nch, &header) > 0) {
  /* 从输入的文件读取数据到buffer */
  if (glopts.verbosity > 1)
   if (++frameNum % 10 == 0) /* 出错 */
    fprintf(stderr, "[%4u]\r", frameNum);
  fflush(stderr);
  win_buf[0] = &buffer[0][0];
  win_buf[1] = &buffer[1][0];
  
  adb = available_bits(&header, &glopts);	// 计算比特预算

  lg_frame = adb / 8;
  if (header.dab_extension) {
   /* in 24 kHz we always have 4 bytes */
   if (header.sampling_frequency == 1)
    header.dab_extension = 4;
   /* You must have one frame in memory if you are in DAB mode                 */
   /* in conformity of the norme ETS 300 401 http://www.etsi.org               */
      /* see bitstream.c            */
   if (frameNum == 1)
    minimum = lg_frame + MINIMUM;
   adb -= header.dab_extension * 8 + header.dab_length * 8 + 16;
  }
  
    {
   int gr, bl, ch;
   /* New polyphase filter
     Combines windowing and filtering. Ricardo Feb'03 */
   for (gr = 0; gr < 3; gr++)   /* 36个样值分为3组 */
    for (bl = 0; bl < 12; bl++)   /* 每组做12次子带分解 */
     for (ch = 0; ch < nch; ch++)
      WindowFilterSubband(&buffer[ch][gr * 12 * 32 + 32 * bl], ch, &(*sb_sample)[ch][gr][bl][0]);    /* 多相滤波器组 */
  }

#ifdef REFERENCECODE
  {
   /* Old code. left here for reference */
   int gr, bl, ch;
   for (gr = 0; gr < 3; gr++)
    for (bl = 0; bl < SCALE_BLOCK; bl++)
     for (ch = 0; ch < nch; ch++) {
      window_subband(&win_buf[ch], &(*win_que)[ch][0], ch);
      filter_subband(&(*win_que)[ch][0], &(*sb_sample)[ch][gr][bl][0]);
     }
  }
#endif

#ifdef NEWENCODE
  scalefactor_calc_new(*sb_sample, scalar, nch, frame.sblimit);
  find_sf_max(scalar, &frame, max_sc);
  if (frame.actual_mode == MPG_MD_JOINT_STEREO) {
   /* this way we calculate more mono than we need */
   /* but it is cheap */
   combine_LR_new(*sb_sample, *j_sample, frame.sblimit);
   scalefactor_calc_new(j_sample, &j_scale, 1, frame.sblimit);
  }
#else
  scale_factor_calc(*sb_sample, scalar, nch, frame.sblimit); // 计算比例因子
  pick_scale(scalar, &frame, max_sc);    // 选择比例因子
  if (frame.actual_mode == MPG_MD_JOINT_STEREO) { /* 先忽略 */
    /* this way we calculate more mono than we need */
    /* but it is cheap */
   combine_LR(*sb_sample, *j_sample, frame.sblimit);
   scale_factor_calc(j_sample, &j_scale, 1, frame.sblimit);
  }
#endif

  /* 选择心理声学模型,计算SMR */
  if ((glopts.quickmode == TRUE) && (++psycount % glopts.quickcount != 0)) {
   /* We're using quick mode, so we're only calculating the model every
      'quickcount' frames. Otherwise, just copy the old ones across */
   for (ch = 0; ch < nch; ch++) {
    for (sb = 0; sb < SBLIMIT; sb++)
     smr[ch][sb] = smrdef[ch][sb];
   }
  } else {
   /* calculate the psymodel */
   switch (model) {
   case -1:
    psycho_n1(smr, nch);
    break;
   case 0: /* Psy Model A */
    psycho_0(smr, nch, scalar, (FLOAT)s_freq[header.version][header.sampling_frequency] * 1000); // smr为输出
    break;
   case 1:
    psycho_1(buffer, max_sc, smr, &frame);
    break;
   case 2:
    for (ch = 0; ch < nch; ch++) {
     psycho_2(&buffer[ch][0], &sam[ch][0], ch, &smr[ch][0], //snr32,
      (FLOAT)s_freq[header.version][header.sampling_frequency] *
      1000, &glopts);
    }
    break;
   case 3:
    /* Modified psy model 1 */
    psycho_3(buffer, max_sc, smr, &frame, &glopts);
    break;
   case 4:
    /* Modified Psycho Model 2 */
    for (ch = 0; ch < nch; ch++) {
     psycho_4(&buffer[ch][0], &sam[ch][0], ch, &smr[ch][0], // snr32,
      (FLOAT)s_freq[header.version][header.sampling_frequency] *
      1000, &glopts);
    }
    break;
   case 5:
    /* Model 5 comparse model 1 and 3 */
    psycho_1(buffer, max_sc, smr, &frame);
    fprintf(stdout, "1 ");
    smr_dump(smr, nch);
    psycho_3(buffer, max_sc, smr, &frame, &glopts);
    fprintf(stdout, "3 ");
    smr_dump(smr, nch);
    break;
   case 6:
    /* Model 6 compares model 2 and 4 */
    for (ch = 0; ch < nch; ch++)
     psycho_2(&buffer[ch][0], &sam[ch][0], ch, &smr[ch][0], //snr32,
      (FLOAT)s_freq[header.version][header.sampling_frequency] *
      1000, &glopts);
    fprintf(stdout, "2 ");
    smr_dump(smr, nch);
    for (ch = 0; ch < nch; ch++)
     psycho_4(&buffer[ch][0], &sam[ch][0], ch, &smr[ch][0], // snr32,
      (FLOAT)s_freq[header.version][header.sampling_frequency] *
      1000, &glopts);
    fprintf(stdout, "4 ");
    smr_dump(smr, nch);
    break;
   case 7:
    fprintf(stdout, "Frame: %i\n", frameNum);
    /* Dump the SMRs for all models */
    psycho_1(buffer, max_sc, smr, &frame);
    fprintf(stdout, "1");
    smr_dump(smr, nch);
    psycho_3(buffer, max_sc, smr, &frame, &glopts);
    fprintf(stdout, "3");
    smr_dump(smr, nch);
    for (ch = 0; ch < nch; ch++)
     psycho_2(&buffer[ch][0], &sam[ch][0], ch, &smr[ch][0], //snr32,
      (FLOAT)s_freq[header.version][header.sampling_frequency] *
      1000, &glopts);
    fprintf(stdout, "2");
    smr_dump(smr, nch);
    for (ch = 0; ch < nch; ch++)
     psycho_4(&buffer[ch][0], &sam[ch][0], ch, &smr[ch][0], // snr32,
      (FLOAT)s_freq[header.version][header.sampling_frequency] *
      1000, &glopts);
    fprintf(stdout, "4");
    smr_dump(smr, nch);
    break;
   case 8:
    /* Compare 0 and 4 */ 
    psycho_n1(smr, nch);
    fprintf(stdout, "0");  
    smr_dump(smr, nch);

    for (ch = 0; ch < nch; ch++)
     psycho_4(&buffer[ch][0], &sam[ch][0], ch, &smr[ch][0], // snr32,
      (FLOAT)s_freq[header.version][header.sampling_frequency] *
      1000, &glopts);
    fprintf(stdout, "4");
    smr_dump(smr, nch);
    break;
   default:
    fprintf(stderr, "Invalid psy model specification: %i\n", model);
    exit(0);
   }
   
   if (glopts.quickmode == TRUE)
    /* copy the smr values and reuse them later */
    for (ch = 0; ch < nch; ch++) {
     for (sb = 0; sb < SBLIMIT; sb++)
      smrdef[ch][sb] = smr[ch][sb];
    }
    
    if (glopts.verbosity > 4)
	smr_dump(smr, nch);
 }  

#ifdef NEWENCODE
  sf_transmission_pattern(scalar, scfsi, &frame);
  main_bit_allocation_new(smr, scfsi, bit_alloc, &adb, &frame, &glopts);
  //main_bit_allocation (smr, scfsi, bit_alloc, &adb, &frame, &glopts);

	if (error_protection)
	  CRC_calc(&frame, bit_alloc, scfsi, &crc);
	  
  write_header(&frame, &bs);
  //encode_info (&frame, &bs);
  if (error_protection)
   putbits(&bs, crc, 16);
  write_bit_alloc(bit_alloc, &frame, &bs);
  //encode_bit_alloc (bit_alloc, &frame, &bs);
  write_scalefactors(bit_alloc, scfsi, scalar, &frame, &bs);
  //encode_scale (bit_alloc, scfsi, scalar, &frame, &bs);
  subband_quantization_new(scalar, *sb_sample, j_scale, *j_sample, bit_alloc,
   *subband, &frame);
  //subband_quantization (scalar, *sb_sample, j_scale, *j_sample, bit_alloc,
  //   *subband, &frame);
  write_samples_new(*subband, bit_alloc, &frame, &bs);
  //sample_encoding (*subband, bit_alloc, &frame, &bs);

#else
  transmission_pattern(scalar, scfsi, &frame);
  main_bit_allocation(smr, scfsi, bit_alloc, &adb, &frame, &glopts); // 比特分配
  if (error_protection)
   CRC_calc(&frame, bit_alloc, scfsi, &crc);
  encode_info(&frame, &bs);  // 编码
  if (error_protection)
   encode_CRC(crc, &bs);
  encode_bit_alloc(bit_alloc, &frame, &bs);
  encode_scale(bit_alloc, scfsi, scalar, &frame, &bs);
  subband_quantization(scalar, *sb_sample, j_scale, *j_sample, bit_alloc, *subband, &frame); // 量化
  sample_encoding(*subband, bit_alloc, &frame, &bs);
#endif

  /* If not all the bits were used, write out a stack of zeros */
  for (i = 0; i < adb; i++)
   put1bit(&bs, 0);
  if (header.dab_extension) {
	/* Reserve some bytes for X-PAD in DAB mode */
	putbits(&bs, 0, header.dab_length * 8);

   for (i = header.dab_extension - 1; i >= 0; i--) {
    CRC_calcDAB(&frame, bit_alloc, scfsi, scalar, &crc, i);
    /* this crc is for the previous frame in DAB mode  */
    if (bs.buf_byte_idx + lg_frame < bs.buf_size)
     bs.buf[bs.buf_byte_idx + lg_frame] = crc;
    /* reserved 2 bytes for F-PAD in DAB mode  */
    putbits(&bs, crc, 8);
   }
   putbits(&bs, 0, 16);
  }

	frameBits = sstell(&bs) - sentBits;
  if (frameBits % 8) { /* a program failure */
   fprintf(stderr, "Sent %ld bits = %ld slots plus %ld\n", frameBits,
    frameBits / 8, frameBits % 8);
   fprintf(stderr, "If you are reading this, the program is broken\n");
   fprintf(stderr, "email [mfc at NOTplanckenerg.com] without the NOT\n");
   fprintf(stderr, "with the command line arguments and other info\n");
   exit(0);
}

sentBits += frameBits;
}

	close_bit_stream_w(&bs);


	if ((glopts.verbosity > 1) && (glopts.vbr == TRUE)) {
		int i;
#ifdef NEWENCODE
		extern int vbrstats_new[15];
#else
  extern int vbrstats[15];
#endif
  fprintf(stdout, "VBR stats:\n");
  for (i = 1; i < 15; i++)
   fprintf(stdout, "%4i ", bitrate[header.version][i]);
  fprintf(stdout, "\n");
  for (i = 1; i < 15; i++)
#ifdef NEWENCODE
   fprintf(stdout, "%4i ", vbrstats_new[i]);
#else
			fprintf(stdout, "%4i ", vbrstats[i]);
#endif
		fprintf(stdout, "\n");
	}	

 fprintf(stderr,
  "Avg slots/frame = %.3f; b/smp = %.2f; bitrate = %.3f kbps\n",
  (FLOAT)sentBits / (frameNum * 8),
  (FLOAT)sentBits / (frameNum * 1152),
  (FLOAT)sentBits / (frameNum * 1152) *s_freq[header.version][header.sampling_frequency]);
	if (fclose(musicin) != 0) {
		fprintf(stderr, "Could not close \"%s\".\n", original_file_name);
		exit(2);
	}
	fprintf(stderr, "\nDone\n");

	time(&end_time);
	total_time = end_time - start_time;
	printf("total time is %d\n", total_time);

	exit(0);
}

乐音:
在这里插入图片描述
在这里插入图片描述
噪音
在这里插入图片描述
混合在这里插入图片描述
在这里插入图片描述

参考链接:频域掩蔽: link.

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
【优质项目推荐】 1、项目代码均经过严格本地测试,运行OK,确保功能稳定后才上传平台。可放心下载并立即投入使用,若遇到任何使用问题,随时欢迎私信反馈与沟通,博主会第一时间回复。 2、项目适用于计算机相关专业(如计科、信息安全、数据科学、人工智能、通信、物联网、自动化、电子信息等)的在校学生、专业教师,或企业员工,小白入门等都适用。 3、该项目不仅具有很高的学习借鉴价值,对于初学者来说,也是入门进阶的绝佳选择;当然也可以直接用于 毕设、课设、期末大作业或项目初期立项演示等。 3、开放创新:如果您有一定基础,且热爱探索钻研,可以在此代码基础上二次开发,进行修改、扩展,创造出属于自己的独特应用。 欢迎下载使用优质资源!欢迎借鉴使用,并欢迎学习交流,共同探索编程的无穷魅力! 基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip 基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip 基于业务逻辑生成特征变量python实现源码+数据集+超详细注释.zip
提供的源码资源涵盖了安卓应用、小程序、Python应用和Java应用等多个领域,每个领域都包含了丰富的实例和项目。这些源码都是基于各自平台的最新技术和标准编写,确保了在对应环境下能够无缝运行。同时,源码中配备了详细的注释和文档,帮助用户快速理解代码结构和实现逻辑。 适用人群: 这些源码资源特别适合大学生群体。无论你是计算机相关专业的学生,还是对其他领域编程感兴趣的学生,这些资源都能为你提供宝贵的学习和实践机会。通过学习和运行这些源码,你可以掌握各平台开发的基础知识,提升编程能力和项目实战经验。 使用场景及目标: 在学习阶段,你可以利用这些源码资源进行课程实践、课外项目或毕业设计。通过分析和运行源码,你将深入了解各平台开发的技术细节和最佳实践,逐步培养起自己的项目开发和问题解决能力。此外,在求职或创业过程中,具备跨平台开发能力的大学生将更具竞争力。 其他说明: 为了确保源码资源的可运行性和易用性,特别注意了以下几点:首先,每份源码都提供了详细的运行环境和依赖说明,确保用户能够轻松搭建起开发环境;其次,源码中的注释和文档都非常完善,方便用户快速上手和理解代码;最后,我会定期更新这些源码资源,以适应各平台技术的最新发展和市场需求。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值