【发布时间】:2021-04-16 07:53:15
【问题描述】:
所以我有版本列,其中包含不均匀模式的数据,因为有些有 ',' 后跟日期,有些有 ',-' 模式。
df.head()
17 Paperback,– 1 Nov 2016
18 Mass Market Paperback,– 1 Jan 1991
19 Paperback,– 2016
20 Hardcover,– 24 Nov 2018
21 Paperback,– Import, 4 Oct 2018
如何将日期提取到单独的列中。我尝试使用 str.split() 但找不到要提取的特定模式。有什么方法可以做到吗?
【问题讨论】:
-
obj.str.extract('((?:\d+\s\w+\s+)?\d{4}$)')
标签: python-3.x pandas dataframe machine-learning feature-engineering