【问题标题】:CMU Sphinx Acoustic model training hangsCMU Sphinx 声学模型训练挂起
【发布时间】:2014-04-04 05:06:00
【问题描述】:

我正在使用 CMU sphinx 训练声学模型。我有大约 200 小时的语音数据。当我运行训练脚本时(sphinxtrain 运行,最初我的 4 个 CPU 内核处于 100% 状态,我的机器变热了,所以它正在做一些计算。但是,现在脚本看起来像是挂在第 20 模块第 3 阶段。经过检查,我意识到我的机器上运行了 4 个“Perl 5.12”副本,CPU 利用率为 0%,并更新了训练目录中名为 qmanager/bw.2.4.out 的文件(Baum Welch 模型?)。这个文件不断更新;我有一个 SSD 驱动器。

我的问题是这是否正常(CPU 使用率为 0%),有没有办法加快训练速度。

【问题讨论】:

    标签: speech-recognition cmusphinx sphinx4


    【解决方案1】:

    我的问题是这是否正常(CPU 使用率为 0%),有没有办法加快训练速度。

    不,有错误。您可以在 logdir 文件夹中的日志中查看详细信息。很可能您错误地指定了某个数据文件或库的路径。有时候重启就好了。

    首先确保 an4 教程适合你。

    有一种方法可以加快训练速度

    它一定很快。如果您启用 8 个核心的训练,一个 200 小时的模型应该在 1 天内训练。

    【讨论】:

    • 谢谢尼古拉。两个错误我得到以下两个错误“INFO:cmn.c(175):CMN:14.39 0.26 -0.38 0.19 -0.53 -0.12 -0.22 -0.44 -0.18 -0.37 0.01 -0.32 -0.12 ERROR:“backward.c” ,第 421 行:无法将音频与成绩单对齐:未达到搜索的最终状态错误:“baum_welch.c”,第 324 行:扬声器_6/06_004012 被忽略”。假设它与培训日有关,我忽略了它。有什么见解吗?
    • 此错误不相关。您需要检查 logdir 中的所有错误,而不仅仅是您注意到的一个错误。您可以提供数据库文件夹进行分析。就像我说的,您可以先尝试在较小的数据库上进行训练。
    • 我尝试了一个小得多的数据集(我自己的,而不是 an4),但仍然遇到相同的问题,它一直在编写我在原始帖子中提到的文件。在.html文件中,没有错误;我也grep了logdir目录,那里也没有错误。
    • 你需要读取logdir中的日志,而不是grep它们。您可以分享它们以获得更有意义的建议。为了有效地获得帮助,您可以共享整个小型数据库。您也可以分享您构建 an4 数据库的尝试。
    • 谢谢尼古拉。我的脚本正在删除导致问题的“feat.params”。我还有其他问题,但至少现在没有挂起..
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2017-08-19
    • 2018-02-08
    • 2020-05-21
    • 1970-01-01
    相关资源
    最近更新 更多