【发布时间】:2014-12-18 08:04:13
【问题描述】:
我在 win 7 64 位上运行 Python 3.4。
基本上我有一个如下所示的 CSV 文件:
#Begin
#Column1Title;Column2Title;Column3Title;Column4Title
value1;value2;value3;value4
#End
#Begin
#Column1Title;Column2Title;Column3Title;Column4Title;Column5Title;Column6Title
value1;value2;value3;value4;value5;value6
value1;value2;value3;value4;value5;value6
#End
....
单个 CSV 文件包含由 #begin 和 #end 标签分隔的多个表(具有不同的列数)。每个表都有一个标题(列标题),它与文件的其他表无关,该文件有将近 14 000 行。
我只想确定#Begin 和#end 标签的位置,以便有效地提取这些标签中的数据,我想避免逐行读取文件,除非有人另有指示.
我试图绕过 Pandas,安装了 0.15.2 版本。到目前为止,我还没能用它制作出任何接近我想要的东西。
由于文件很长,下一步将像这样同时解析多个文件,我正在寻找执行时间方面最有效的方法。
【问题讨论】:
标签: python csv windows-7 python-3.4