【发布时间】:2011-09-03 15:55:49
【问题描述】:
我一直在研究音频分析。我有一个 WAV 流读入内存,我需要对数据执行各种功能,例如 FFT。我一直在阅读这个理论,但我不确定我是否正确阅读它。读取流时,我输出了一堆数字,我猜这是采样数据(44100 hz)。我是否在这个流上执行所有功能?那么,对于 1024 个样本的窗口,我是否只需从流中获取前 1024 个数字?然后我是否要在这 1024 集上执行 FFT 和所有其他功能并在流的其余部分重复?
我开始理解它的理论,以及对样本求和的想法等......但我不确定这在实现方面意味着什么。
编辑-为了澄清我得到的流值,数字与-0.432,-0.065... 一致。
【问题讨论】:
标签: audio implementation analysis fft wav