【发布时间】:2013-06-05 07:40:39
【问题描述】:
我想构建一个程序来检测用户的录音与另一个录音的接近程度,以纠正用户的发音。例如:
- 我录下自己说“早上好”
- 我让一个外国学生录制“早上好”
- 比较他的录音和我的录音,看看他的发音是否足够好。
我在一些语言学习工具中看到了这一点(我相信 Rosetta Stone 会这样做),但它是如何完成的?请注意,我们只处理语音(而不是音乐)。我应该研究哪些算法或库?
【问题讨论】:
-
您还可以查看 [如何以编程方式比较 2 个音频文件?][1]。 [1]:stackoverflow.com/questions/6979352/…
标签: algorithm machine-learning audio