【发布时间】:2019-09-05 15:33:12
【问题描述】:
我有一个如下所示的数据框,其中包含 96,000 行和不同数量的相同 ID。我想选择具有相同 ID 的行,然后从日期最早的行中选择销售额。
ID Date1 Date2 Date3 Sales
------ ---------- ---------- ---------- -------
3351 7/18/18 1/8/2017 9/7/2016 $240
3351 9/15/14 $670
3351 4/5/2017 9/7/16
8222 6/6/2013 2/5/2008 $943
在这种情况下,对于 ID 3351,我们会选择 670 美元,因为第二个 dup 中的 Date2 是 2014 年。
for(i in length(data))
{
if(duplicated(dat17[i,1]) == TRUE)
{
pmin(dat17[1,7:9], dat17[2,7:9])
}
}
我正在尝试使用 for 循环来查找重复项并进行比较,但我不确定如何使用 duplicated() 函数给出的多行。 pmin() 仅适用于向量,我需要使用数据框中的数据。
【问题讨论】:
标签: r