【发布时间】:2018-04-23 17:32:27
【问题描述】:
我的 pandas 数据框中有两个日期时间列,df:
d = pd.DatetimeIndex(start='1700-01-01', end='2017-01-01', freq='1D')
df = pd.DataFrame({'date1':d})
df['date2'] = df['date1'].sample(frac=1).values
我正在使用以下公式计算这些日期之间的周数:
df['weeks'] = (df['date1'].subtract(df['date2'])).dt.days/7
在包含 1100 万行的数据帧上,这需要的时间比我预期的要长 - 大约 10 分钟。
有没有更快的方法来做到这一点?
【问题讨论】:
-
您可以考虑使用
numba...您可以在问题正文中提供几行数据吗? -
@COLDSPEED 添加示例
标签: python performance pandas memory-efficient