【发布时间】:2021-07-07 05:01:51
【问题描述】:
我正在尝试构建一个虚拟麦克风,它接收物理麦克风的输入流,使用用 Python 编写的神经网络模型修改音频,并用我的程序的输出声音流(近乎实时)替换声音流,以便其他应用(例如 Zoom、Skype 等)将接收我的应用修改后的音频流,适用于 Mac 和 Windows。
过去几个小时我一直在阅读,到目前为止发现了几个可能(?)能够在这里工作的库:WebRTC、Soundflower 等。有谁知道是否已经有一个很好的库可以做或促进这?这可能会涉足题外话领域,但如果这完全在 Python 中是可行的,例如通过 eel 或类似的,有没有人知道任何可以进行相同类型的音频处理的库?
谢谢!
【问题讨论】:
-
这是音频驱动程序堆栈级别的交互,因此非常特定于操作系统