【发布时间】:2015-09-12 00:57:03
【问题描述】:
我想为“Sinhala Language speech recognition”建立新的声学模型、新字典、新语言模型 僧伽罗语字符是基于 Unicode 的。例如 A=අ,I=ඉ,U=උ,KA=ක,BA=බ。
我确实通过了CMUSphinx Tutorial For Developers。但这对我没有帮助。它适用于英语。
语言模型应该是 ARPA 模型。以及如何用英语音素映射僧伽罗语 Unicode,以及如何用不同的声音训练语言模型。 是否有任何工具可用于生成基于 Unicode 的语言模型?
【问题讨论】:
标签: speech-recognition cmusphinx sphinx4