【发布时间】:2020-05-24 05:32:22
【问题描述】:
我刚刚读到,在 pos_tags 的帮助下,词形还原结果最好。因此,我遵循了以下代码,但得到了计算 POS_tags 的 KeyError。下面是代码
from nltk import pos_tag
x['Phrase']=x['Phrase'].transform(lambda value:value.lower())
x['Phrase']=x['Phrase'].transform(lambda value:pos_tag(value))
from nltk.stem import WordNetLemmatizer
lemmatizer = WordNetLemmatizer()
x['Phrase_lemma']=x['Phrase'].transform(lambda value: ' '.join([lemmatizer.lemmatize(a[0],pos=a[1]) for a in value]))
错误:
KeyError Traceback (most recent call last)
<ipython-input-8-c2400a79a016> in <module>
1 from nltk.stem import WordNetLemmatizer
2 lemmatizer = WordNetLemmatizer()
----> 3 x['Phrase_lemma']=x['Phrase'].transform(lambda value: ' '.join([lemmatizer.lemmatize(a[0],pos=a[1]) for a in value]))
KeyError: 'DT'
【问题讨论】:
标签: python text nlp nltk lemmatization