【发布时间】:2019-12-09 20:48:46
【问题描述】:
添加可复制性:
data.frame(
product=c(rep("x",2),rep("y",3)),
price_category_from=c(10,20,10,20,30),
price=c(30,31,31,30,27)
)
如下所示,我有一个表,我想按product 分组并更改price_category_from 列的值以找到最小值price。
product price_category_from price
x 10 30
x 20 31
y 10 31
y 20 30
y 30 27
如下所示,结果表应包含最少的price.new 列,用于更改price_category_from 列中的值。例如,产品x 的两行中的price.new 为30,因为price_category_from 类别的后续price 值更大。而对于产品y,每个后续price_category_from 类别的最小值都会发生变化,因为下一个price 值更小。
price_category_from 中的值是按递增顺序排列的区间。
product price_category_from price price.new
x 10 30 30
x 20 31 30 **
y 10 31 31
y 20 30 30
y 30 27 27
我希望我能够解释这个问题。我非常感谢您的帮助(最好是data.table)。非常感谢您提前。
【问题讨论】:
标签: r dplyr data.table reshape2