当前位置:   article > 正文

关于GPT-SoVITS语音合成的效果展示(西游之西天送葬团)

关于GPT-SoVITS语音合成的效果展示(西游之西天送葬团)

使用效果总结

使用的是2024年03月21日22点28分更新的版本。

使用起来很方便,从它“自带界面”这点就能看出,易于使用也是目的之一,而且从训练到推理的每个步骤都能在界面中完成。

集成了多个实用工具,包括语音伴奏分离、训练集自动分割、中文ASR和文本标注,帮助初学者创建训练数据集和GPT/SoVITS模型。

合成效果虽然需要抽卡,但参数不变的情况下,也很稳定,几乎都没有大变化,每次都能抽到好卡。

不像VITS那样,GPT-SoVITS完全没有大佐口音,并且有较好的感情表达。

推理速度则不尽人意,比VITS要慢一些。

有个缺点,也可以说是bug。GPT-SoVITS在推理是需要一段5到10秒的参考音频,当要合成的文本字数大于参考语言的总字数时,就可能在合成音频中出现一截参考音频。据开发者在issue中回复,回音参考泄露的问题时有发生,原因也挺多的,建议更换参考音频和缩短合成文本。

效果上依然和微软的语音合成有些差距,但时比VITS要好上不少。

合成效果展示

链接:西游之西天送葬团
提取码:ztjk

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/我家小花儿/article/detail/345094
推荐阅读
  

闽ICP备14008679号