【发布时间】:2014-06-26 00:26:54
【问题描述】:
我有一个 numpy 数组作为
[['6.5' '3.2' '5.1' '2.0' 'Iris-virginica']
['6.1' '2.8' '4.0' '1.3' 'Iris-versicolor']
['4.6' '3.2' '1.4' '0.2' 'Iris-setosa']
['6.0' '2.2' '4.0' '1.0' 'Iris-versicolor']
['4.7' '3.2' '1.3' '0.2' 'Iris-setosa']
['6.7' '3.1' '5.6' '2.4' 'Iris-virginica']]
根据标签 'Iris-virginica'、'Iris-setosa' 和 'Iris-virginica' 将此数据分成 3 个单独的 numpy 数组的最快方法是什么,以便
Iris-virginicaarray 仅包含
[['6.5' '3.2' '5.1' '2.0']['6.7' '3.1' '5.6' '2.4']]
Iris-setosaarray 仅包含 [['4.6' '3.2' '1.4' '0.2'] ['4.7' '3.2' '1.3' '0.2']]
Iris-versicolorarray 仅包含 [['6.1' '2.8' '4.0' '1.3']['6.0' '2.2' '4.0' '1.0']]
【问题讨论】:
-
不清楚你在问什么。您有每个具有不同值的重复“类”。另外,您希望如何计算协方差?关于其他所有“类”?
-
CoDA 课程的同路人?
-
@Ffisegydd:我换了个问题。
-
FWIW 使用
pandas会简单得多;你基本上想要groupby+meanIIUC。
标签: python python-2.7 python-3.x numpy pandas