【发布时间】:2021-12-06 17:10:24
【问题描述】:
我从 URL 读取了一个 excel 文件,需要进行一些清理才能保存它。在原始的 excel 文件中,前几行有一些标志和空条目,然后才是真正的数据开始。 excel 文件中的日期列(未命名 0:) 显示为日期,但由于某种原因读入 pandas 时,它会转换为数字。使用 astype 和 pd.to_datetime 将列转换为日期,但日期不正确。有什么建议吗?
注意:虽然日期列在excel表格中显示为日期,但它的类型是通用的。我可以先在 excel 文件中手动更改类型,但我不想这样做,因为我想自动化该过程。
如果要产生数据,代码如下:
from requests import get
import pandas as pd
url = 'http://rigcount.bakerhughes.com/static-files/55ff50da-ac65-410d-924c-fe45b23db298'
# make HTTP request to fetch data
r = get(url)
# check if request is success
r.raise_for_status()
# write out byte content to file
with open('out.xlsb', 'wb') as out_file:
out_file.write(r.content)
Canada_Oil_Gas = pd.read_excel('out.xlsb', sheet_name='Canada Oil & Gas Split', engine='pyxlsb')
【问题讨论】:
-
这能回答你的问题吗? Pandas Read_Excel Datetime Converter
-
我尝试了该帖子中的所有建议。我仍然得到如上图所示的 DATE 列。
标签: python excel pandas date types