【发布时间】:2021-02-01 08:51:53
【问题描述】:
我有数以千计的 .csv 文件,其中包含大量的感官数据,而且都是浮点数。但也有一些文件中的一些行显示日期和时间信息,并出现在文件的不同位置,如下图所示:
在上图中,前两行位于开头,但其他文件可以位于其他位置。使用pandasread_csv函数读取文件时,应该跳过这种非浮动行以避免错误。
我使用skiprows 函数在恒定行索引处跳过特定行,但问题是不需要的行在文件中的位置是可变的。
for j in range(len(all_list)):
path = os.path.join(path, all_list[j])
# print(path)
df_data = pd.read_csv(path, skiprows=[0, 1], header=None)
print("data shape: ", df_data.shape)
我的问题是: 如何仅读取基于浮动的行并自动跳过所有文件中的非浮动数据?
【问题讨论】:
-
您可能必须使用 python
csv模块并遍历每一行