【发布时间】:2010-06-13 13:56:24
【问题描述】:
我想要做的是有一个子程序,它每 200 毫秒分析一次给定的声音文件,并将特定频率范围的频率强度值(从 0 到 1 作为浮点数)吐出到数组中我后来保存。然后,该值将继续用作应该“频闪”到音频文件的图形的不透明度值。
问题是,我以前从未涉足音频分析,也不知道从哪里开始。我看过 pymedia 和 scipy/numpy 认为我可以使用 FFT 来实现这一点,但我不确定如何操纵这些数据以得到预期的结果。 pymedia 的 SpectrAnalyzer 类的文档几乎不存在,并且网站上的示例实际上不适用于该库的最新版本 - 这并没有让我的生活更轻松。
我将如何开始这个项目?我完全不知道我应该使用哪些库。
【问题讨论】:
-
您可能会在这里找到有用的代码:swharden.com/blog/…
标签: python fft audio-analysis