【发布时间】:2012-01-02 04:31:03
【问题描述】:
我正在尝试同时分析音频和视频特征。我的音频语音特征是使用隐马尔可夫模型工具包以 100fps 采样的梅尔频率倒谱系数。我的视觉特征来自我构建的一个唇形跟踪程序,并以 29.97fps 进行采样。
我知道我需要对我的视觉特征进行插值,以使采样率也达到 100fps,但我在网上找不到很好的解释或教程。我发现的大部分帮助都来自语音识别社区,该社区代表读者假设了插值知识,即大多数都用简单的“插值视觉特征以使采样率等于 100fps”来涵盖该步骤。
谁能指出我正确的方向?
谢谢一百万
【问题讨论】:
-
这个问题可能更适合dsp.stackexchange,com,因为它实际上是关于信号处理而不是编程本身。
标签: signal-processing interpolation hidden-markov-models