【问题标题】:SAPI: Server-side dictationSAPI:服务器端听写
【发布时间】:2011-03-30 14:08:09
【问题描述】:

各位, 我正在尝试构建一个服务器端系统,在该系统中我使用 Microsoft SAPI 来:

  • 在服务器中同时执行多个听写式识别。
  • 此外,所有识别都可能使用不同的说话人配置文件(我的应用程序会识别用户并向 SAPI 指示要加载哪个配置文件)。
  • 我还想以编程方式训练各种用户配置文件。

我已经知道上述某些内容在托管代码(即 System.speech 命名空间)中是不可能的。谁能告诉我我在理论上使用 SAPI 5.x 尝试做的事情是否可行?

感谢您的帮助。

-拉吉

【问题讨论】:

  • 您最终找到解决方案了吗?如果你这样做了,你应该把它作为答案发布。
  • 我最终使用了以这种方式使用 SAPI 的自助解决方案。查看nvoq.com

标签: speech-recognition sapi speech-to-text


【解决方案1】:

您需要Microsoft Speech Server 来执行此操作。您仍然可以使用托管代码,但需要使用 Microsoft.Speech.Recognition 库(使用服务器引擎)而不是 System.Speech.Recognition(使用桌面引擎)。

除此之外,当然,您想要的一切都可以在原生 SAPI 中完成。

【讨论】:

  • 埃里克,感谢您的回复。 Microsoft.Speech.Recognition 库不允许听写语法。在我的研究中,我发现微软当前基于服务器的语音产品要么不做听写,要么不暴露这种能力。此外,语音 API 的托管代码变体仅限于最常见的用例:编写语音感知用户交互应用程序(如在 not server 中)。看起来原生 SAPI 是满足我需要的方法。
  • 你仍然需要服务器引擎来做你想做的事。桌面引擎不适用于电话质量的音频。
  • 是的。我正在考虑从基于 Web(flash/silverlight)的 UI 或移动应用程序将音频流式传输到基于 SAPI 的服务器。
猜你喜欢
  • 1970-01-01
  • 2019-01-03
  • 2016-06-25
  • 2019-06-14
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多