【发布时间】:2016-11-16 13:28:57
【问题描述】:
我有一个包含已知列的输入文件,假设有两列 Name 和 Sex。有时它有标题行Name,Sex,有时它没有:
1.csv:
Name,Sex
John,M
Leslie,F
2.csv:
John,M
Leslie,F
事先知道列的身份,有没有一种很好的方法可以使用相同的read_csv 命令来处理这两种情况?基本上,我想指定names=['Name', 'Sex'],然后让它仅在标题存在时推断header=0。我能想到的最好办法是:
1) 在执行
read_csv之前读取文件的第一行,并设置 适当的参数。2) 只需
df = pd.read_csv(input_file, names=['Name', 'Sex']), 然后检查第零行是否与标题相同,如果 所以删除它(然后可能需要重新编号行)。
但这对我来说似乎不是什么不寻常的用例。有没有我没有想到的使用read_csv 的内置方法?
【问题讨论】: