Python开源语音识别库实现语音交互功能
使用Python和一些开源库可以实现一个开源的语音识别库的语音交互功能。以下是一个示例代码:
import speech_recognition as sr
import pyttsx3
def listen():
r = sr.Recognizer()
mic = sr.Microphone()
with mic as source:
r.adjust_for_ambient_noise(source)
print('请说话...')
audio = r.listen(source)
try:
text = r.recognize_google(audio, language='zh-CN')
return text
except sr.UnknownValueError:
print('抱歉,无法识别音频')
except sr.RequestError as e:
print('无法连接到Google Speech Recognition API: {0}'.format(e))
def speak(text):
engine = pyttsx3.init()
engine.say(text)
engine.runAndWait()
while True:
command = listen()
if command == '退出':
break
else:
print('您说的是:', command)
speak('您说的是:' + command)
这个示例代码使用了两个开源库:speech_recognition用于语音识别,pyttsx3用于语音合成。
代码中的listen函数使用麦克风监听用户的语音输入,并使用Google的语音识别API将语音转换为文本。speak函数使用文本转语音引擎将文本转换为语音输出。
在主循环中,程序会反复监听用户的语音输入并进行处理。如果用户说的是'退出',程序会退出;否则,程序会打印出用户说的内容,并将内容转换为语音输出。
请注意,上述代码中使用了Google的语音识别API,需要确保网络连接正常才能使用该API。如果无法连接到API,可以尝试使用其他的语音识别库或API。
原文地址: https://www.cveoy.top/t/topic/qqT4 著作权归作者所有。请勿转载和采集!