【发布时间】:2019-05-23 14:41:23
【问题描述】:
我希望使用 pandas 读取具有以下格式的 csv 文件:
atrrth
sfkjbgksjg
airuqghlerig
Name Roll
airuqgorqowi
awlrkgjabgwl
AAA 67
BBB 55
CCC 07
如你所见,如果我使用pd.read_csv,我会得到相当明显的错误:
ParserError: Error tokenizing data. C error: Expected 1 fields in line 4, saw 2
但我希望将整个数据放入一个数据框中。使用error_bad_lines = False 将删除重要的东西,只留下垃圾值
这些是下面给出的 2 个可能的列名:
Name : [Name , NAME , Name of student]
Roll : [Rollno , Roll , ROLL]
如何做到这一点?
【问题讨论】:
-
您的列名是保持不变还是随着 .csv 文件而变化?
-
没有。它没有。这些列有一个可能的名称列表
-
你能编辑你的问题并给出这些列名列表
-
[[姓名:姓名,姓名,学生姓名],[滚动:滚动,滚动,滚动]]
-
我也会编辑问题
标签: python pandas csv tokenize parse-error