基于Tensorflow的VCTK语音识别例子测试_vctk 数据集 wav

作者：Monodyee | 2024-03-26 09:29:09

踩

vctk 数据集 wav

语音识别是深度学习早先攻克的几个领域之一。传统的基于HMM等的语音识别精度一直比较受限。但是深度学习还是给语音识别的精度带来了一个飞跃性的提高。本文在网上找了段代码实现了下，感觉非常简单就可以复现。

不过看了过程，也非常简单，主要有几步：

（1）　下载VCTK数据集；

（2）　对数据集，提取每个WAV文件的MFCC特征以及对应的语音文本标注语料。

（3）　设置CTC的损失目标函数。

（4）　进行训练。

这样训练完保存模型，则可以开始进行训练。

训练效果如图所示：

声明：本文内容由网友自发贡献，不代表【wpsshop博客】立场，版权归原作者所有，本站不承担相应法律责任。如您发现有侵权的内容，请联系我们。转载请注明出处：https://www.wpsshop.cn/w/Monodyee/article/detail/316072