【发布时间】:2021-12-28 10:23:18
【问题描述】:
我正在使用流式音频以及 wav 文件测试 google Speech-to-Text API。 我正在使用来自电话的音频:8000 采样率,8 位,mulaw 编码。 Google 配置已正确设置。
当我使用正常序列对其进行测试时,它会返回正确的转录。 然而,当我说一个词(尤其是一个数字)时,我经常没有从 api 获得响应 -> 就好像它没有输入一样。流式转录和批量转录都会发生这种情况。
有人知道为什么会这样吗?如何解决?
【问题讨论】:
-
是否可以转码为 LINEAR16 或 FlAC 编码? Cloud Speech-to-Text API 的best practices 建议相同。
-
您好,如果您觉得有帮助,请考虑接受/投票。
标签: speech-recognition speech-to-text google-speech-api google-speech-to-text-api