【发布时间】:2020-04-30 15:38:44
【问题描述】:
我有一个 Wav 格式的音频文件要转录:
我的代码是:
import speech_recognition as sr
harvard = sr.AudioFile('speech_file.wav')
with harvard as source:
try:
audio = r.listen(source)
#print("Done")
except sr.UnknownValueError:
exec()
r.recognize_google(audio)
我确实收到了输出:
Out[20]: 'thank you for calling my name is Denise who I have a pleasure speaking with hi my name is Mary Jane. Good afternoon Mary Jane I do have your account open with your email'
但是,在此之后还有很多话要说。我认为它只捕获了语音的这一部分,因为在音频文件中说出“电子邮件”一词后会有短暂的停顿。我尝试设置持续时间,但收到错误消息:
import speech_recognition as sr
harvard = sr.AudioFile('speech_file.wav')
with harvard as source:
try:
audio = r.listen(source,duration = 200)
#print("Done")
except sr.UnknownValueError:
exec()
r.recognize_google(audio)
Traceback (most recent call last):
File "<ipython-input-24-30fb65edc627>", line 5, in <module>
audio = r.listen(source,duration = 200)
TypeError: listen() got an unexpected keyword argument 'duration'
我该怎么做才能让我的代码转录整个音频文件并且在出现停顿时不会停止打印文本?
【问题讨论】:
-
您收到错误消息,因为监听函数没有名为持续时间的参数。详情见源码:github.com/Uberi/speech_recognition/blob/master/…
-
是的,我知道,但解决方案是什么?我希望它转录整个 wav 文件
-
如果您不提供文件,我无法重现错误,因此:什么都没有。
-
@NikolasRieble 我如何在这里上传文件?
标签: python nlp speech-recognition pyaudio