【发布时间】:2020-12-16 15:24:42
【问题描述】:
假设我们有一个二维数组,如下所示:
array1 = np.array([[1,4,3, 64356,5435,434],
[11,46,3, 7356,585,74],
[51,406,3, 769,5435,24],
[12,45,5, 656,135,134],
[112,475,5, 656,1385,134],
[13,46, 5, 656,1385,19]])
第 4 行和第 5 行在术语或它们的 2,3,4 列方面不是唯一的,我们希望删除其中之一。 有没有一种有效的方法来删除数组的行并使其行在所选列方面是唯一的?
【问题讨论】:
-
@QuangHoang 但不允许按列进行选择性。
-
在
array1[:,your_select_column]上工作并获取索引? -
如果使用 pandas 是一个选项。您可以将数组转换为数据框并使用
drop_duplicates函数,该函数接受用于选择列的subset参数 -
pd.DataFrame(array1).drop_duplicates(your_select_column)?
标签: python arrays numpy unique