【问题标题】:Recognition of the file without grammar constrains识别没有语法约束的文件
【发布时间】:2014-02-16 22:55:43
【问题描述】:

作为用于将音频转换为文本的 gram 文件,我们只能识别有限数量的单词。有没有办法将任何音频转录为文本。我们能否增强 gram 文件以包含所有英文单词,以便可以识别任何英文单词?或者我们可以做些别的事情,以便我将任何音频文件转换为文本的目的可以被释放?我浪费了很多时间。任何想法将不胜感激。提前致谢。

【问题讨论】:

    标签: speech-recognition cmusphinx


    【解决方案1】:

    要熟悉语音识别概念,请先阅读教程

    http://cmusphinx.sourceforge.net/wiki/tutorial

    包含所有单词的语法称为语言模型。美国英语的语言模型可在此处下载:

    https://sourceforge.net/projects/cmusphinx/files/Acoustic%20and%20Language%20Models/US%20English%20Generic%20Language%20Model/

    要为其他语言创建语言模型,您可以查看教程

    http://cmusphinx.sourceforge.net/wiki/tutoriallm

    要使用语言模型进行解码,您可以使用 sphinx4 中的转录器演示或带有 -lm 选项的 pocketsphinx_continuous 二进制文件。像这样:

     pocketsphinx_continuous -infile file.wav -lm en_us.lm.dmp
    

    【讨论】:

    • Thanxx Nikolay.....你能指导我如何编辑 sphinx4.jar 以便它可以使用上述模型并将音频文件作为输入。
    • 在 sphinx4 中,此模型已默认用于转录器演示。详情见cmusphinx.sourceforge.net/wiki/tutorialsphinx4
    • 但是 sphinx4 中包含的 hello world 程序使用了一个非常短的 gram 文件。如果它使用语言模型,那么 gram 文件有什么用。如果需要,那么我们如何增加 gram 文件中的单词以检测音频文件中所说的任何单词。请帮忙
    • 请点击链接并仔细阅读。你好像没读过。
    • 我阅读了所有的东西......你能帮我如何使用你在 sphinx4 中提供的语言模型吗?在制作可以将音频转换为文本的代码时,该教程有点令人困惑。请
    猜你喜欢
    • 1970-01-01
    • 2016-02-09
    • 1970-01-01
    • 1970-01-01
    • 2018-02-07
    • 2015-07-27
    • 1970-01-01
    • 2017-07-17
    • 1970-01-01
    相关资源
    最近更新 更多