【发布时间】:2019-11-21 14:11:32
【问题描述】:
我有一个具有以下结构的数据框(3 列):
DATE,QUOTE,SOURCE
2019-11-21,1ºTEST/2ºTEST DONE, KAGGLE
我要做的是在 QUOTE 列上创建一个子字符串,以便仅使用最后一次出现之后的单词(在本例中为单词“TEST”)生成一个新列。
我的预期结果:
DATE,QUOTE, SATUS, SOURCE
2019-11-21,1ºTEST/2ºTEST DONE, DONE, KAGGLE
为此,我正在尝试使用以下代码:
import pandas as pd
df = pd.read_excel (filename)
split = lambda x: len(x['QUOTE'].rsplit('TEST',1)[0])
df["STATUS"] = df.apply(split, axis=1)
print(df["STATUS"].unique())
但是我只是打印数字而不是“完成”。
我做错了什么?
谢谢!
【问题讨论】:
标签: python pandas substring strsplit