【发布时间】:2014-02-16 22:55:43
【问题描述】:
作为用于将音频转换为文本的 gram 文件,我们只能识别有限数量的单词。有没有办法将任何音频转录为文本。我们能否增强 gram 文件以包含所有英文单词,以便可以识别任何英文单词?或者我们可以做些别的事情,以便我将任何音频文件转换为文本的目的可以被释放?我浪费了很多时间。任何想法将不胜感激。提前致谢。
【问题讨论】:
标签: speech-recognition cmusphinx
作为用于将音频转换为文本的 gram 文件,我们只能识别有限数量的单词。有没有办法将任何音频转录为文本。我们能否增强 gram 文件以包含所有英文单词,以便可以识别任何英文单词?或者我们可以做些别的事情,以便我将任何音频文件转换为文本的目的可以被释放?我浪费了很多时间。任何想法将不胜感激。提前致谢。
【问题讨论】:
标签: speech-recognition cmusphinx
要熟悉语音识别概念,请先阅读教程
http://cmusphinx.sourceforge.net/wiki/tutorial
包含所有单词的语法称为语言模型。美国英语的语言模型可在此处下载:
要为其他语言创建语言模型,您可以查看教程
http://cmusphinx.sourceforge.net/wiki/tutoriallm
要使用语言模型进行解码,您可以使用 sphinx4 中的转录器演示或带有 -lm 选项的 pocketsphinx_continuous 二进制文件。像这样:
pocketsphinx_continuous -infile file.wav -lm en_us.lm.dmp
【讨论】: