开源项目:https://github.com/jerryuhoo/VTuberTalk
解决错误无数多个,修改多个脚本,苦熬几昼夜,终于杀青,功成垂败。特比注意,训练样本少于500条语句,效果灰常差,可以直接放弃。
1、安装
cpu版本:如果只是单纯使用,建议安装这个版本。
conda create -n paddlespeech python=3.8
conda activate paddlespeech
pip install -r requirements_cpu.txt -i https://pypi.tuna.tsinghua.edu.cn/simple
2、安装cpu版本的paddlepaddle
# cpu 版本的示例, 需要paddle 2.3.0以上版本
python3 -m pip install paddlepaddle==2.4.2 -i https://pypi.tuna.tsinghua.edu.cn/simple
python3 -c "import paddle;paddle.utils.run_check()"
3、获取音频
从B站获取音频的方法: 可以用bilibili助手下载Vtuber的录播flv文件,再转成wav文件。
从YouTube获取音频的方法: 可以用TamperMonkey上的YouTube下载器下载mp4文件,再转成wav文件。
安装依赖库:
pip install pydub
python tools/video
本文详细介绍了如何从零开始训练个人专属的TTS模型,包括音频采集、降噪、分割、文本获取、数据预处理、模型训练等多个步骤,并列出在训练过程中可能遇到的错误及解决办法,最终使用PaddleSpeech和MFA完成模型构建。
订阅专栏 解锁全文
897

被折叠的 条评论
为什么被折叠?



