【发布时间】:2020-10-28 14:35:58
【问题描述】:
我在熊猫系列中标记单词时遇到问题。
我的系列名为df:
text
0 This monitor is a great deal for the price.
1 I would recommend it.
2 poor packaging.
dtype: object
我试过df_tokenized=nltk.word_tokenize(df),但结果是TypeError: expected string or bytes-like object
我还尝试了.apply(lambda row:) 的 3 种变体
df_tokenized=df.apply(lambda row: nltk.word_tokenize(row['text']), axis=1)
> TypeError: <lambda>() got an unexpected keyword argument 'axis'
df_tokenized=df.apply(lambda row: nltk.word_tokenize(row['text']))
> TypeError: string indices must be integers
df_tokenized=df.apply(lambda row: nltk.word_tokenize(row[1]))
> TypeError: 'float' object is not subscriptable
还有其他方法来标记系列中的单词吗?
【问题讨论】:
-
如果您觉得这个答案有用,您能否将问题标记为已回答(答案左侧的灰色勾号)并点赞?