【发布时间】:2018-04-17 21:58:15
【问题描述】:
我的问题是这个链接中回答得很好的问题的延伸:
我已经在下面发布了答案,当字符串包含单词“ball”时,它们会被过滤掉:
In [3]: df[df['ids'].str.contains("ball")]
Out[3]:
ids vals
0 aball 1
1 bball 2
3 fball 4
现在我的问题是:如果我的数据中有很长的句子,并且我想用“ball”和“field”来识别字符串怎么办?这样当只有一个单词出现时,它会丢弃包含单词“ball”或“field”的数据,但保留字符串中同时包含两个单词的数据。
【问题讨论】:
-
顺便说一句,如果搜索固定字符串(即不是正则表达式),您通常可以使用
df['ids'].str.contains("ball", regex=False)来提高速度。