linux系统下可用的语音转文字方法（Fish Speech）

作者：神奇cpp | 2024-07-31 03:42:49

踩

fish speech

推荐一款Linux下可用的，全新的文本转语音(TTS)，计算机朗读文本—Fish Speech
Fish Speech具有高度自定义和灵活性，目前支持Linux和Windows系统。
运行需要2GB的GPU内存进行运算，使用Flash-Attn进行推理和训练，支持VQGAN和Text2Semantic模型。
在这里插入图片描述
安装方法：

安装 pytorch

pip3 install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu121

安装 flash-attn (适用于linux)

pip3 install ninja && MAX_JOBS=4 pip3 install flash-attn --no-build-isolation

安装 fish-speech

pip3 install -e .

git地址：

https://speech.fish.audio/zh/latest/zh/

可以看到2023/12/17:更新了 text2semantic 模型, 支持无音素模式。非常非常的新，推荐python3环境更新到最新的版本。

声明：本文内容由网友自发贡献，不代表【wpsshop博客】立场，版权归原作者所有，本站不承担相应法律责任。如您发现有侵权的内容，请联系我们。转载请注明出处：https://www.wpsshop.cn/w/神奇cpp/article/detail/906845