【问题标题】:pocketsphinx batch vs continuouspocketsphinx 批处理 vs 连续
【发布时间】:2018-08-19 06:52:16
【问题描述】:
使用 pocketsphinx 连续和批处理解码 .wav 格式的音频文件时,结果差异非常显着。我想问一下 :
1.为什么pocketsphinx batch一般比pocketsphinx Continuous效果好?
2.有没有关于pocketsphinx批量和连续工作的确切解释?
3.使用pocketsphinx连续解码时,cmninit值不正确,因此我想循环wav音频文件,结果非常好。有没有办法自动获取 cmninit 值而不是硬编码?
4. 在pocketsphinx 批处理中没有识别出词汇量之外的单词。是不是也输出了最接近未识别词的词。为什么没有发生?
【问题讨论】:
标签:
cmusphinx
pocketsphinx
【解决方案1】:
- 为什么pocketsphinx batch 通常比pocketsphinx Continuous 提供更好的结果?
Batch 将音频作为一个整体进行分析,以便正确估计 cmn 值。
- 对于 pocketsphinx 批处理和连续工作的方式有什么确切的解释吗?
在源代码中
- 使用pocketsphinx连续解码时,cmninit值不正确,因此我想循环wav音频文件,结果非常好。有没有办法自动获取 cmninit 值而不是硬编码?
有很多高级算法,例如used by Google
- 在pocketsphinx 批处理中无法识别词汇表之外的单词。是不是也输出了最接近未识别词的词。为什么没有发生?
这就是语音识别算法的工作原理,它需要要查找的单词列表。像 espnet 这样的现代端到端系统可以识别子词单元,因此可以处理任意词汇。