虽然
SpeechRecognition
使语音到文本的转录变得非常容易,我很困惑如何播放录制的音频(键入
speech_recognition.AudioData
).我做了一些谷歌搜索,几乎随机地尝试了一些库(例如:。
playsound
,
pydub
)但没有成功。我想,第一次将音频写入内存并回放时没有问题,但我很震惊,没有人想立即从内存中回放(也许我高估了我的谷歌搜索技能)。
显然,识别器实例不需要此功能,但检查是否必须调整环境噪声不是很好吗?
import speech_recognition as sr
# Initialize recognizer class (for recognizing the speech)
rec = sr.Recognizer()
# Reading Microphone as source
# listening the speech and store in audio_text variable
with sr.Microphone() as source: #device_index=1
print("Talk")
audio_text = rec.listen(source)
print("thx")
# TODO: play back 'audio_text'