【发布时间】:2019-08-19 05:43:53
【问题描述】:
我正在尝试对数据框 tex 中的单词进行词干化
data 是一个数据框,karma 是文本列,zargan 是单词的字典和单词的根
for a in range(1,100000):
for j in data.KARMA[a].split():
pattern = r'\b'+j+r'\b'
data.KARMA[a] = re.sub(pattern, str(zargan.get(j,j)),data.KARMA[a])
print(data.KARMA[1])
我想更改文本中的单词和词根
【问题讨论】:
标签: python regex stemming lemmatization