【问题标题】:Watson 'Speech to text' not recognizing microphone input properlyWatson 'Speech to text' 无法正确识别麦克风输入
【发布时间】:2018-06-07 10:22:36
【问题描述】:

我正在使用为 IBM Watson 服务提供的 Unity SDK。我尝试使用为语音到文本识别提供的“ExampleStreaming.cs”示例。我在统一编辑器中测试应用程序。

此示例使用麦克风作为音频输入,并从用户那里获取语音输入的结果。但是,当我使用麦克风作为输入时,转录结果远非正确。当我说“创建一个黑匣子”时,结果是不合适的,结果这个词与输入完全无关。

当我使用预先录制的语音片段时,输出是完美的。 该服务是否对印度口音执行不正确? 麦克风输入识别不佳的原因是什么?

文档说: “一般来说,该服务对背景噪音很敏感。例如,引擎噪音、工作设备、街道噪音和谈话会显着降低准确性。此外,通常安装在移动设备和平板电脑上的麦克风往往不够用。当使用专业麦克风捕捉质量更好的音频时,服务表现最佳。”

我使用罗技耳机麦克风作为输入源。

【问题讨论】:

    标签: unity3d ibm-watson watson


    【解决方案1】:

    萨蒂什,

    尽量“清理”音频 - 通过限制背景噪音。另请注意,您可以使用两种不同的处理模型之一——一种用于宽带,一种用于窄带。两者都试一下,看看哪个最适合您的输入设备。

    此外,您会发现底层语音模型无法处理您可能正在寻找的所有领域特定术语。在这些情况下,您可以自定义和扩展语音模型,如使用 Custom Language Models (https://console.bluemix.net/docs/services/speech-to-text/custom.html#custom) 中的文档中所述。虽然这涉及更多,但它通常会在准确性和整体可用性方面产生巨大差异。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2023-01-21
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-06-11
      • 1970-01-01
      • 2016-05-08
      • 1970-01-01
      相关资源
      最近更新 更多