【发布时间】:2018-06-07 10:22:36
【问题描述】:
我正在使用为 IBM Watson 服务提供的 Unity SDK。我尝试使用为语音到文本识别提供的“ExampleStreaming.cs”示例。我在统一编辑器中测试应用程序。
此示例使用麦克风作为音频输入,并从用户那里获取语音输入的结果。但是,当我使用麦克风作为输入时,转录结果远非正确。当我说“创建一个黑匣子”时,结果是不合适的,结果这个词与输入完全无关。
当我使用预先录制的语音片段时,输出是完美的。 该服务是否对印度口音执行不正确? 麦克风输入识别不佳的原因是什么?
文档说: “一般来说,该服务对背景噪音很敏感。例如,引擎噪音、工作设备、街道噪音和谈话会显着降低准确性。此外,通常安装在移动设备和平板电脑上的麦克风往往不够用。当使用专业麦克风捕捉质量更好的音频时,服务表现最佳。”
我使用罗技耳机麦克风作为输入源。
【问题讨论】:
标签: unity3d ibm-watson watson