【发布时间】:2016-08-16 00:57:55
【问题描述】:
我是 Python 新手。最近,我有一个项目在 xml 文件中处理大量健康数据。 这是一个例子:
在我的数据中,大约有 100 个,每个都有不同的 id、origin、type 和 text。我想将所有这些都存储在数据中,以便我可以训练这个数据集,我脑海中的第一个想法是使用 2D 数组(一个存储 id 和 origin,另一个存储文本)。但是,我发现功能太多,我想知道每个文档属于哪些功能。
谁能推荐一个最好的方法。
【问题讨论】:
-
您可以使用以 id 作为键的字典和字典(以特征作为键,将它们的值作为值)或对象作为值来逃避。
-
我将图片复制到您的问题中,但最好使用
{ }而不是图片发布相关代码。 -
就您的问题而言,我建议使用 xml 解析包来获取可以导入字典或可能的数据框的数据。现在的情况,你的问题太宽泛了。
标签: python arrays large-data