SpeechRecognition可以支持多种模型语音转文字,感觉vosk还不错,使用起来也简单一些;百度也有PaddleSpeech,但是安装起来太麻烦,不是这个库版本不对就是那个库有问题,用起来不方便;
安装SpeechRecognition库:
pip install SpeechRecognition
安装vosk库:
pip install vosk
使用vosk库还需要下载对应的模型,去官网VOSK Models下载:

中文的有3个模型,模型小的运行快,准确度没有大的好,选一个下载完zip解压就行,代码里配置目录和模型,为了方便直接解压到项目目录里了:

另外需要wav语音测试文件,可以自己录音或者去在线免费文字转语音 - TTSMaker官网 | 马克配音 制造点wav语音文件;
demo:
#!/usr/bin/env python3
# coding = utf-8
"""
# Project: workspace_py
# File: test_speech_recognition_vo

本文介绍了如何安装和使用SpeechRecognition库以及vosk库进行语音转文字,比较了不同模型的性能,提到百度的PaddleSpeech在安装上的困难,同时提到了使用麦克风录音和处理不同格式音频的方法,但指出SpeechRecognition缺少标点恢复功能。
最低0.47元/天 解锁文章
1万+

被折叠的 条评论
为什么被折叠?



