【问题标题】:Abbreviation Reference for NLTK Parts of SpeechNLTK 词性的缩写参考
【发布时间】:2015-09-02 01:53:03
【问题描述】:

我正在使用 nltk 来查找句子中每个单词的词性。它返回的缩写我既不能完全直观也找不到好的文档。

跑步:

import nltk
sample = "There is no spoon."
tokenized_words = nltk.word_tokenize(sample)
tagged_words = nltk.pos_tag(tokenized_words)
print tagged_words

返回:

[('There', 'EX'), ('is', 'VBZ'), ('no', 'DT'), ('spoon', 'NN'), ('.', '.')]

在上面的示例中,我正在寻找 DTEX 以及其他的含义。

到目前为止,我最好的方法是在 Natural Language Processing with Python 中搜索提及的关注缩写,但必须有更好的东西。我也确实找到了一些基于文献的资源,但我不知道如何判断使用的是哪个 nltk。

【问题讨论】:

标签: python nlp nltk


【解决方案1】:

您已经提到的link 有两个不同的标签集。

有关标签集文档,请参阅 nltk.help.upenn_tagset()nltk.help.brown_tagset()

在这个特定的例子中,这些标签来自Penn Treebank tagset

您还可以通过以下方式阅读这些标签:

nltk.help.upenn_tagset('DT')
nltk.help.upenn_tagset('EX')

【讨论】:

猜你喜欢
  • 2019-08-07
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2012-11-11
  • 1970-01-01
  • 2012-05-27
  • 1970-01-01
相关资源
最近更新 更多