【发布时间】:2016-05-09 05:49:38
【问题描述】:
我目前正在我的 data.table dat 上执行以下操作,这是参与我的代码的最长时间。
dat[ , max_ts:= max(TS, na.rm = T), .(col_new)]
dat_new <- dat[TS == max_ts, ]
我在上面所做的是,首先我为col_new 列的每个值/类别找到最大值TS,然后只保留出现最大值TS 的那些行。
我的目标是达到dat_new
我需要在循环中对不同的数据表执行上述操作。 (这里的时间有点难切,请不要在此提出任何建议)
我希望以更快的方式完成以上 2 个步骤。有没有更好、更有效的方法来做同样的事情?
【问题讨论】:
-
请展示一个可重现的例子
标签: r data.table subset