【发布时间】:2020-06-05 18:09:57
【问题描述】:
我有一个 csv 文件,我正在尝试将其转换为数据框。但是数据有一些重复的额外标题材料。例如:
Results Generated Date Time
Sampling Info
Time; Data
1; 4.0
2; 5.2
3; 6.1
Results Generated Date Time
Sampling Info
Time; Data
6; 3.2
7; 4.1
8; 9.7
如果是干净的 csv 文件,没有额外的标题材料,我正在使用
df = pd.read_csv(r'Filelocation', sep=';', skiprows=2)
但我不知道如何删除第二组标题信息。我不想丢失第二个标题集下面的数据。有没有办法删除它以便数据干净?第二个标头集并不总是在同一位置(基本上是数据采集错误)。
谢谢!
【问题讨论】:
-
希望我的代码能帮到你,我posted it in stack overflow
标签: python pandas data-cleaning