【问题标题】:pocketsphinx batch vs continuouspocketsphinx 批处理 vs 连续
【发布时间】:2018-08-19 06:52:16
【问题描述】:

使用 pocketsphinx 连续和批处理解码 .wav 格式的音频文件时,结果差异非常显着。我想问一下 : 1.为什么pocketsphinx batch一般比pocketsphinx Continuous效果好? 2.有没有关于pocketsphinx批量和连续工作的确切解释? 3.使用pocketsphinx连续解码时,cmninit值不正确,因此我想循环wav音频文件,结果非常好。有没有办法自动获取 cmninit 值而不是硬编码? 4. 在pocketsphinx 批处理中没有识别出词汇量之外的单词。是不是也输出了最接近未识别词的词。为什么没有发生?

【问题讨论】:

    标签: cmusphinx pocketsphinx


    【解决方案1】:
    1. 为什么pocketsphinx batch 通常比pocketsphinx Continuous 提供更好的结果?

    Batch 将音频作为一个整体进行分析,以便正确估计 cmn 值。

    1. 对于 pocketsphinx 批处理和连续工作的方式有什么确切的解释吗?

    在源代码中

    1. 使用pocketsphinx连续解码时,cmninit值不正确,因此我想循环wav音频文件,结果非常好。有没有办法自动获取 cmninit 值而不是硬编码?

    有很多高级算法,例如used by Google

    1. 在pocketsphinx 批处理中无法识别词汇表之外的单词。是不是也输出了最接近未识别词的词。为什么没有发生?

    这就是语音识别算法的工作原理,它需要要查找的单词列表。像 espnet 这样的现代端到端系统可以识别子词单元,因此可以处理任意词汇。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2021-10-02
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-12-02
      • 1970-01-01
      • 2012-11-01
      相关资源
      最近更新 更多