我也有类似的问题。我处理网络上的大量音频。我必须自动检查音频降级、音频播放等。我在 Groovy 或 Ruby 中找不到帮助我的库(我没有检查 Python),所以我调用了一个已安装的程序 (sox)如果听到音频,它会实时检查。
这是我的常规调用/脚本:
def audioCheck = "sox -t coreaudio Soundflower /Users/me/project/record.wav silence 1 0.1 1% 1 .1 1%".execute()
audioCheck.waitFor()
println "EXIT VALUE FOR SOX IS: ${audioCheck.exitValue()}"
if(audioCheck.exitValue() == 0){
// some stuff would happen now, if exit code is 0
}
关于 Core Audio 和“Soundflower”
sox 调用使用 -t coreaudio 指定音频板(在 Linux 上,您可能会使用 alsa 而不是 'coreaudio' - coreaudio 是 OSX 音频接口。) "Soundflower " 参数是我在 Soundflower 中创建的通道。单独录制声音对我来说很重要(因为我正在检查音频质量)。例如,如果您使用默认通道,如 alsa default 或 coreaudio default ,它会拿起你的麦克风......所以如果你旁边的人打喷嚏......它会破坏测试。
通过使用虚拟音频通道(如 OSX 上的 Soundflower),您可以将所有音频“输出”设置为输出“Soundflower”,然后在该通道上运行 sox 命令...收听来自虚拟通道的系统音频。
您可以改用默认频道(但它会在听到房间内的其他噪音时结束。)
我使用 groovy 任务异步运行该代码...因此该代码被包装在以下内容中:
def listener = task { ... my script above ... }
由于它是异步监听的,它不会阻塞其余的测试。
Sox 命令
我使用的实际 sox 实时命令来自这个人的视频(看看他使用了一些不同的参数):
https://www.youtube.com/watch?v=Q5ntlKE0ze4
扩展它
通过能够自动录制通过浏览器播放的音频,然后使用 PESQ 算法确定录制的音频与正在播放的原始音频的接近程度,我进一步推动了它。如果您对此感兴趣,请随时查看我的帖子:
http://sdet.us/webrtc-audio-quality-automation-with-pesq/
Python PCAP 抓取
也许与您正在做的事情无关,但我也尝试过使用 Pyshark 库从数据包捕获中重建音频......它更复杂,也许更脆弱。但如果有兴趣,这是我的实现:
http://sdet.us/python-pcap-parsing-audio-from-sip-call/