【发布时间】:2019-07-09 14:52:41
【问题描述】:
一个样本数据集的结构如下
- Home_HeatSensor_AA.CSV
- Office_HeatSensor_BB.CSV
- Ship_ElevationSensor_XXYY.CSV
AA.CSV 具有以下列,带有示例行
Time AA AB BB Site Type
0 1:00 5 4 5 Home Heat
BB.CSV 格式类似
Time AA AB BB Site Type
0 1:00 6 2 4 Office Heat
但是,XXYY.CSV 的格式大不相同
Time XX XY YY Site Type
0 1:00 1.332 12.1123 4.212 Ship Elevation
我需要将这三个 CSV 文件合并成一个主 CSV 文件,格式如下
Time AA AB AB XX XY YY Site Type
0 1:00 5 4 4 Home Heat
0 1:00 6 2 2 Office Heat
0 1:00 1.332 12.1123 4.212 Ship Elevation
我曾尝试过使用 pandas,但结果好坏参半。下面的代码将加入数据,但会切换时间、站点和单元的列顺序。理想情况下,我希望这两个保持不变,时间在订单前面,站点和单位保持最后两列值
for filename in filepaths:
df = pd.read_csv(filename, index_col=None, header=0, parse_dates=True,infer_datetime_format=True)
li.append(df)
【问题讨论】:
标签: python pandas csv dataframe