【发布时间】:2012-02-12 23:24:07
【问题描述】:
如何在服务器端实现语音识别(请不要建议HTML5's x-webkit-speech、javascript 等)?该程序将音频文件作为输入,并以足够的准确性提供音频文件的文本转录。我可以使用哪些选项?
我已经尝试实现Sphin4 with Voxforge model,但准确度太差了(它们可能也是我的配置中的一些问题,我还在努力学习)。在一篇文章中,我读到当我们使用<input name="speech" id="speech" type="text" x-webkit-speech /> 时,输入被发送到外部服务器,并且该服务器比识别 并将数据发送回浏览器。
如何设置该服务器?任何现有的开源服务器如果能够以最小的错误率识别英文句子,也会很有用。
【问题讨论】:
标签: java speech-recognition speech speech-to-text