【发布时间】:2016-09-28 13:48:06
【问题描述】:
我有几个不同的数据文件需要使用 genfromtxt 导入。每个数据文件都有不同的内容。例如,文件 1 可能包含所有浮点数,文件 2 可能包含所有字符串,文件 3 可能包含浮点数和字符串等的组合。此外,列数因文件而异,由于有数百个文件,我不知道每个文件中哪些列是浮点数和字符串。但是,每列中的所有条目都是相同的数据类型。
有没有办法为 genfromtxt 设置一个转换器来检测每列中的数据类型并将其转换为正确的数据类型?
谢谢!
【问题讨论】:
-
你会用熊猫吗?
pandas.readcsv比numpy.genfromtxt强大得多,并且会自动为您完成所有这些工作。 -
问题是我需要能够将输出转换为 numpy 数组以进行进一步处理。我听说 datafame.as_matrix() 返回一个对象数组。所以我更喜欢使用 genfromtxt。
-
dataframe.to_records()会给你一个记录数组,这可能就是你想要的。在 numpy 数组中存储混合类型只能通过记录数组或对象数组来完成。 -
是的,这行得通!谢谢!
-
好的——我添加了一个完整的答案
标签: python numpy type-conversion genfromtxt