【发布时间】:2019-01-25 14:57:41
【问题描述】:
我想从数据框的列中删除停用词。 列内有需要拆分的文本。
例如,我的数据框如下所示:
ID Text
1 eat launch with me
2 go outside have fun
我想在text column 上应用停用词,所以它应该被拆分。
我试过这个:
for item in cached_stop_words:
if item in df_from_each_file[['text']]:
print(item)
df_from_each_file['text'] = df_from_each_file['text'].replace(item, '')
所以我的输出应该是这样的:
ID Text
1 eat launch
2 go fun
这意味着停用词已被删除。 但它不能正常工作。我也尝试反之亦然,将我的数据框设为系列,然后循环遍历它,但我也没有工作。
感谢您的帮助。
【问题讨论】:
-
您对此的预期输出是什么?
-
感谢您的评论,我更新了问题:)
标签: python pandas dataframe text stop-words