【发布时间】:2018-02-26 21:28:02
【问题描述】:
我正在尝试导入带有时间戳的大型 .csv 文件,并将其他列作为浮点数。时间戳如下所示:
2013-08-01 00:00:00 PST
它位于 df 中标记为“时间戳”的列中。
我正在尝试使用 pandas 来导入它,特别是使用 read_csv 函数,并为 date_parser 参数添加我自己的日期解析器。
我创建一个日期解析器如下:
dateparse=lambda x: pd.datetime.strptime(x, '%Y-%m-%d %H:%M:%S %Z')
并按如下方式执行read_csv
df=pd.read_csv(outputFile, sep=',', skiprows=range(1,8), header=None, names=names, usecols=['timestamp', 'power1','power2'], parse_dates=['timestamp'], date_parser=dateparse)
但是我收到一个错误,
时间数据'#file...... output/R3-12.47-3_swing_node.csv'与格式'%Y-%m-%d %H:%M:%S %Z'不匹配
p>
我相信这是因为每个时间戳末尾的“PST”。我该如何解决这个问题?谢谢。
【问题讨论】:
-
确实没有这样的时区:
'PST' in pytz.all_timezones是False。
标签: python pandas date-parsing