【发布时间】:2020-07-07 19:21:40
【问题描述】:
我正在尝试在 python 中加载音频文件并使用谷歌语音识别对其进行处理
问题在于,与 C++ 不同,python 不显示数据类型、类,或者通过创建新对象和重新打包数据来访问内存以在一种数据类型和另一种数据类型之间进行转换
我不明白如何在 python 中将一种数据类型转换为另一种数据类型
有问题的代码如下,
import speech_recognition as spr
import librosa
audio, sr = librosa.load('sample_data/metal.mp3')
# create a speech recognition object
r = spr.Recognizer()
r.recognize_google(audio)
错误是:
audio_data must be audio data
如何转换音频对象以用于谷歌语音识别
【问题讨论】:
标签: python windows speech-recognition google-speech-api librosa