【问题标题】:Audio file to text file python音频文件到文本文件python
【发布时间】:2015-12-11 18:23:04
【问题描述】:

我想将音频(例如:“.mp3”)文件转换为文本文件。我尝试了不同的方法,例如pyspeechspeech recognition,但我没有得到任何答案。有没有其他方法可以做到这一点..?任何帮助,将不胜感激 !

【问题讨论】:

标签: python windows python-2.7


【解决方案1】:

你试过https://pypi.python.org/pypi/SpeechRecognition/ 吗?这听起来正是您想要的。

我还通过这个blog 找到了CMU Sphinx 项目。它也有 Python 绑定(如文章中所述)。

我发现的另一个项目是 Google 的 Speech to Text API。您可能也想检查一下。这是一个关于这个主题的不错的教程:

【讨论】:

  • SpeechRecognition 看起来会做你想做的事。请注意,它使用网络上的外部语音到文本引擎,因此您需要互联网访问和您使用的任何服务选项的密钥。Textract (textract.readthedocs.org/en/latest) 为文本提取提供了一个简单、统一的界面,并使用 SpeechRecognition 进行处理音频文件。
【解决方案2】:
import speech_recognition as sr
print(sr.__version__)
r = sr.Recognizer()

file_audio = sr.AudioFile('file_audio.wav')

with file_audio as source:
   audio_text = r.record(source)

print(type(audio_text))
print(r.recognize_google(audio_text))

【讨论】:

  • 您知道是否有其他使用 Sphinx 的成语(葡萄牙语)的解决方法?
【解决方案3】:

方式 1:使用 https://github.com/jiaaro/pydubf = open("test.mp3", "rb") first16bytes = f.read(16) 将音频文件转换为字节 (0,1)

方式 2:音频到语音转换器。例如 - 使用 pip 库(如 SpeechRecognition pydub)转换为英语或其他语言。 (但我认为你没有要求这个)

方式3:将mp3转换为Json。如果有人这样做,请分享。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2019-09-24
    • 2018-11-20
    • 2022-01-01
    • 1970-01-01
    • 2017-11-05
    • 2011-11-26
    • 1970-01-01
    相关资源
    最近更新 更多