【问题标题】:What is the Limitation of Training data set -Uima Ruta训练数据集的局限性是什么 -Uima Ruta
【发布时间】:2016-09-21 14:58:15
【问题描述】:

在 TextRuler 视图中,训练数据中的输入数量是否有任何限制。因为它花费了太多时间。有时它会生成规则,否则它会显示一些 GC 开销限制。

如果我尝试使用算法生成的脚本,它会显示一些错误。

错误:

Error in KEP,  line 160, "SCRIPT": found no viable alternative

生成的脚本:

SCRIPTSTART{->MARKONCE(SCRIPT,1,3)} ANY*? SCRIPTEND;
SCRIPTSTART{IS(SCRIPTEND)->MARKONCE(SCRIPT)} ;

【问题讨论】:

    标签: machine-learning uima ruta


    【解决方案1】:

    关于错误:

    错误表明 SCRIPT 未知。是否声明了类型 SCRIPT? 生成的规则可能只是规则,您需要添加导入才能构建正确的脚本。第160行的内容是什么?

    关于 TextRuler 的总体介绍:

    创建该框架是为了在规则工程期间为用户提供支持。它不是针对常见的监督机器学习优化的框架。因此,它没有针对运行时和内存使用进行优化。

    算法为每个示例创建规则并尝试获得良好的覆盖率。因此,示例越多,算法所需的时间就越长。

    内存使用率不应该这么高。这可能是可以解决的问题,但目前对此无能为力。

    免责声明:我是 UIMA Ruta 的开发人员

    【讨论】:

    • 第 160 行的内容是 SCRIPTSTART{->MARKONCE(SCRIPT,1,3)} ANY*?脚本; SCRIPTSTART{IS(SCRIPTEND)->MARKONCE(SCRIPT)} ;这是由Kep算法生成的。我试图运行由kep算法生成的结果规则。然后只有我收到上述错误。
    • 我需要添加哪些导入来构建正确的脚本?
    • 这取决于您的配置。通常,您需要在 TextRuler 视图中的 Preprocess script 中指定的脚本。我假设它是您声明 SCRIPT 的脚本。
    • 是否在参数配置中。
    • 可以加一行SCRIPT my.package.PreprocessScript;
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2018-02-25
    • 2018-01-24
    • 2020-10-16
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多