【发布时间】:2017-12-06 05:43:02
【问题描述】:
我已经尝试过用于 MP3 和 WAV 文件的 Watson Speech to Text API。根据我的观察,与 WAV 相比,如果以 MP3 格式提供相同长度的音频所需的时间更少。对于 MP3 文件,使用不同音频的 10 次连续 API 调用平均耗时 8.7 秒。另一方面,WAV 格式的相同输入平均需要 11.1 秒。服务响应时间是否取决于文件类型?建议使用哪种文件类型以更快地获得结果?
【问题讨论】:
-
你的测量结果如何?这是在上传之后还是包括网络时间?
-
包括网络时间。考虑到网络性能,我们可以考虑少 2-3 秒。在任何情况下,MP3 的运行速度都比 WAV 快。所以想知道性能是否受文件类型影响。
-
我问是因为 mp3 文件通常小于 wav。你检查过这两种情况下传输了多少数据吗?
-
是的,没错。我尝试过使用相同长度的音频,但与 wav 相比,mp3 文件的大小更小。
标签: audio ibm-cloud speech-to-text watson