【发布时间】:2020-09-12 00:31:01
【问题描述】:
我们正在使用按照documentation 以 .wav (RIFF) 格式以 16 位、16kHz 格式记录的数据来训练我们的 Azure 认知服务自定义语音模型。
但是,我们获得了以 48kHz 录制并编码为 MP3 的语音数据集。 Speech Studio 似乎能够毫无问题地使用这些数据训练服务,但我们想知道这样做是否会在更高的采样率下仅用于以更高的速率识别流数据,或者这无关紧要?
【问题讨论】:
标签: speech-to-text azure-cognitive-services