【问题标题】:Add a language in the Stanford parser在斯坦福解析器中添加一种语言
【发布时间】:2011-09-29 12:05:51
【问题描述】:

我想以另一种尚未实现的语言使用斯坦福解析器。

我查看了该网站,但没有发现任何可以帮助我的东西。

我想我要做的就是“只是”创建一个新的语言PCFG.ser,但要这样做吗?

另外,如果有人知道是否应该发布法语和西班牙语?

【问题讨论】:

    标签: parsing nlp stanford-nlp


    【解决方案1】:

    需要几样东西:

    • 您需要一个树库(一组手动解析的树),从中计算解析器中使用的概率
    • 您需要特定于语言的文件(如 xLanguagePack、xTreebankParserParams,它们指定有关语言、树库编码和解析选项的内容
    • 然后您在树库上训练解析器以生成语法文件(请参阅发行版中的 makeSerialized.csh)
    • 您可能需要特定语言的标记器将文本划分为标记
    • 如果您想要 Stanford Dependencies 输出,那么还有一个基于规则的层来定义依赖关系

    从 2011 年开始,我们确实开始使用 Stanford Parser 分发法国模型。从 2015 年开始,我们开始分发西班牙模型。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2015-03-10
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多