【发布时间】:2015-04-11 20:58:21
【问题描述】:
我只是在玩词性标记,并开始使用 OpenNLP。
我正在使用以下代码加载模型(Java):
m_modelFile = new FileInputStream("c:\\DATA\\en-parser-chunking.bin");
m_model = new ParserModel(m_modelFile);
m_parser = ParserFactory.create(m_model);
...
Parse topParses[] = ParserTool.parseLine(sentence, m_parser, 1);
我注意到创建 ParserModel 对象的调用非常慢。可能是 b/c en-parser-chunking.bin 的大小为 35MB。有没有更好的方法来使用它,这样它就不会这么慢?或者,是否有您推荐的 POS 标记器或调用 API 更快的方法?
我一直在玩准确性,它非常好。但是,我对加载模型时的性能不满意......
谢谢大家。
【问题讨论】:
标签: opennlp pos-tagger