【发布时间】:2016-07-06 10:11:29
【问题描述】:
我可以使用 Swift for iOS 录制音频并播放录制的音频文件。我要问的是是否可以检查录制的音频文件的背景噪音和音量/分贝,以便我可以确定它对于我的语音到文本框架来说已经足够好了。框架不是问题,我已经研究了所有可用的框架。
我很好奇是否可以使用 AVFoundation 或 Accelerate Framework 或任何其他框架分析录制的音频文件,以检查音频文件是否足够好/清晰,可以使用语音转文本框架进行处理。
我没有太多的音频知识,但我研究了一下,发现我可以在录制时获得峰值和平均分贝值,但是背景噪音呢?
任何信息都有助于使用 Swift 分析录制的音频文件。
【问题讨论】:
-
请记住
swift和objective-c是高级语言,您很难在以实时优先级运行的严肃程序的DSP 线程上找到它们。为什么?因为所有舒适的东西(分配对象、内存管理、轮询和阻塞等)根本无法在实时线程上进行,除非您正在寻找麻烦。对于 DSP 代码,它运行 快速 至关重要。因此,您可以在swift中编写您的 UI 或控制器,但对于 DSP 部分,例如 SNR 估计,最安全的选择将下降到 plain-C。
标签: ios swift audio speech-to-text