【发布时间】:2013-06-06 21:10:47
【问题描述】:
我需要从格式如下的大型 xml 文件中提取位置和半径数据,并将数据存储在二维 ndarray 中。这是我第一次使用 Python,但我找不到任何有关执行此操作的最佳方法的信息。
<species name="MyHeterotrophEPS" header="family,genealogy,generation,birthday,biomass,inert,capsule,growthRate,volumeRate,locationX,locationY,locationZ,radius,totalRadius">
0,0,0,0.0,0.0,0.0,77.0645361927206,-0.1001871531330136,-0.0013358287084401814,4.523853439106942,234.14575280979898,123.92820420047076,0.0,0.6259920275663835;
0,0,0,0.0,0.0,0.0,108.5705297969604,-0.1411462759900182,-0.001881950346533576,1.0429122163754276,144.1066875513379,72.24884428367467,0.0,0.7017581019907897;
.
.
.
</species>
编辑:按人类标准,我的意思是“大”。我没有任何记忆问题。
【问题讨论】:
-
XML 文本数据本质上是一个 CSV 文件...
-
这个“大”是因为有很多其他你不关心的节点,因为有很多
species节点,还是因为species节点的内容很大? (而且,“大”是一个实际问题吗?试图一次阅读所有内容会给您一个MemoryError或将您的计算机扔进交换地狱之类的东西?) -
物种标签的内容就是“大”。不,这不是一个实际问题,我只是认为它可能是相关的。
-
您的
locationX值中包含尖括号(例如,4.5238534391069>42)。这些应该如何解释? -
好的,如果您在每个文档中只有一个巨大的
species标签,并且“大”不足以引起问题,您可以使用 Martijn Pieters 的答案。
标签: python xml python-2.7 xml-parsing