赞
踩
使用的是2024年03月21日22点28分更新的版本。
使用起来很方便,从它“自带界面”这点就能看出,易于使用也是目的之一,而且从训练到推理的每个步骤都能在界面中完成。
集成了多个实用工具,包括语音伴奏分离、训练集自动分割、中文ASR和文本标注,帮助初学者创建训练数据集和GPT/SoVITS模型。
合成效果虽然需要抽卡,但参数不变的情况下,也很稳定,几乎都没有大变化,每次都能抽到好卡。
不像VITS那样,GPT-SoVITS完全没有大佐口音,并且有较好的感情表达。
推理速度则不尽人意,比VITS要慢一些。
有个缺点,也可以说是bug。GPT-SoVITS在推理是需要一段5到10秒的参考音频,当要合成的文本字数大于参考语言的总字数时,就可能在合成音频中出现一截参考音频。据开发者在issue中回复,回音参考泄露的问题时有发生,原因也挺多的,建议更换参考音频和缩短合成文本。
效果上依然和微软的语音合成有些差距,但时比VITS要好上不少。
链接:西游之西天送葬团
提取码:ztjk
Copyright © 2003-2013 www.wpsshop.cn 版权所有,并保留所有权利。