语音识别——kaldi安装与编译

作者：人工智能uu | 2024-08-18 15:17:12

踩

语音识别——kaldi安装与编译

1、安装

下载源代码：

git clone https://github.com/kaldi-asr/kaldi.git

各目录功能:

./tools目录下面全部都是Kaldi依赖的包。其中主要有：

OpenFST：Weighted Finite State Transducer library，是一个用来构造有限状态自动机的库。我们知道隐马尔科夫模型就可以看成是一个有限状态自动机的。这是最终要的一个包，Kaldi的文档里面说：If you ever want to understand Kaldi deeply you will need to understand OpenFst.
ATLAS：这是一个C++下的线性代数库。做机器学习自然是需要很多矩阵运算的。
IRSTLM:这是一个统计语言模型的工具包。
sph2pipe:这是宾夕法尼亚大学linguistic data consortium（LDC）开发的一款处理SPHERE_formatted数字音频文件的软件，它可以将LDC的sph格式的文件转换成其它格式。

./src目录存放的是Kaldi的源代码。

./egs存放的是Kaldi提供的一些例子。我们现在要做的就是编译安装Kaldi依赖的各种库，然后编译安装Kaldi。

进入 tools/ 查看INSTALL 信息

执行：

 extras/check_dependencies.sh

声明：本文内容由网友自发贡献，不代表【wpsshop博客】立场，版权归原作者所有，本站不承担相应法律责任。如您发现有侵权的内容，请联系我们。转载请注明出处：https://www.wpsshop.cn/w/人工智能uu/article/detail/997982