【发布时间】:2020-12-19 16:00:44
【问题描述】:
我有一个“脏”的 csv 文件加载到 Pandas 数据框中。一列“名称”有时带有前缀(例如,实际名称前的“(3.)”)。
我了解此前缀的分类法,并且知道如何查找索引,我希望从该索引开始保留字符串的其余部分:
df["Indexes"]= df["Name"].str.find(')')
但是:我如何减少对那个索引的限制?
例如,如果“Name”是“(3.) Peter”,我希望它变成“Peter”。
假设,我想使用 slice。我的问题是我需要切片的值每行不同。 -- 如果前缀的长度始终为 4,则下面将起作用,但它不是(有时没有前缀,有时长度为 5)。
pd.Series(df["Name"]).str.slice(4)
我该怎么做?
【问题讨论】:
-
如果你知道模式,你可以使用
.str.replace()。见regex-replace。