使用openSMILE提取MFCC简易教程（Mac）

最新推荐文章于 2022-06-23 16:44:51 发布

夜深读书人

最新推荐文章于 2022-06-23 16:44:51 发布

阅读量2.8k

点赞数 4

文章标签：特征提取 openSMILE

本文链接：https://blog.csdn.net/zergra/article/details/70917460

版权

本文提供了一篇关于在Mac系统上使用openSMILE进行MFCC特征提取的简易教程。作者分享了如何解决安装问题，以及通过shell脚本进行操作。关键在于配置文件的选择和编辑，它定义了提取的特征参数。提取后的文件通常以HTK格式存储，作者建议使用MATLAB的voice tool包进行读取。文章还概述了配置文件的结构和提取流程，包括指定输入、输出目录以及运行shell脚本。

摘要由CSDN通过智能技术生成

openSMILE是一款专门为提取音频特征设计的软件，介绍和安装方法网上已经有很多，这里不再赘述，我摸索openSMILE的使用方法的时候发现网上关于这个软件的教程很少，所以将自己使用的经验写出来放到这个博客上来，希望有人使用这个软件的时候不要再绕那么多弯路。

我安装软件的时候跟visual studio不停地冲突，所以我尝试了一下安装到mac系统上，并且使用shell编写程序脚本，进行特征的提取。

在使用openSMILE的时候，决定了你提取的特征的参数都存储在你所使用的.config文件中，包括了frame size, mfcc的系数的数量，是否包含delta等，小白完全可以在官方提供的配置文件上进行修改，提取自己模型所需的特征值。

在openSMILE中，默认提取后存储的文件格式为compatibility HTK format，在python中我没有找到很合适的function读取这种文件类型，最终我使用的是MATLAB的voice tool 包中的readhtk() 函数。具体的模型建立方法我将在下一篇博客中说明。

现在我们先来看一下官方提供的配置文件MFCC12_0_D_A.conf 。


///////////////////////////////
///// > openSMILE configuration file to extract MFCC features <  //////
/////   HTK target kind: MFCC_0_D_A, numCeps=12                  //////////
/////                                                            //////
///// (c) 2013-2016 audEERING.                                   //////////
/////     All rights reserverd. See file COPYING for details.    //////
////////////////

最低0.47元/天解锁文章

夜深读书人

关注

4
点赞
踩
13

收藏

觉得还不错? 一键收藏
0
评论
使用openSMILE提取MFCC简易教程（Mac）

openSMILE是一款专门为提取音频特征设计的软件，介绍和安装方法网上已经有很多，这里不再赘述，我摸索openSMILE的使用方法的时候发现网上关于这个软件的教程很少，所以将自己使用的经验写出来放到这个博客上来，希望有人使用这个软件的时候不要再绕那么多弯路。我安装软件的时候跟visual studio不停地冲突，所以我尝试了一下安装到mac系统上，并且使用shell编写程序脚本，进行特征的提取。在
复制链接

扫一扫