【发布时间】:2016-12-04 14:49:29
【问题描述】:
有人可以帮我解决以下问题吗?我在附件中有这个 data.frame 需要处理
从交易代码 1 开始 - 必须跟踪客户的所有交易,并且必须在 30 天的时间范围内汇总金额。并且计数器再次为客户重新启动,以便为具有 Transaction code 1 的另一笔交易创建新的汇总记录。并且事务代码为 0 或 1 的事务独立仍将是输出数据帧的一部分,但作为未聚合的行。
我已经尝试过 dplyr、group_by 函数和总结,但我卡住的部分是在函数中包含条件以获得正确答案。
如果我在控制台中输入dput(df),我会得到以下信息:
> dput(df) structure(list(Customer_ID = c(1, 1, 1, 1, 1, 1, 1, 2, 2, 2, 3, 3), date = structure(c(1L, 2L, 3L, 4L, 7L, 10L, 11L, 5L, 6L, 8L, 9L, 12L), .Label = c("01/01/2016", "02/01/2016", "02/15/2016", "02/30/2016", "04/01/2016", "04/20/2016", "05/01/2016", "05/05/2016", "06/01/2016", "07/01/2016", "07/15/2016", "10/01/2016"), class = "factor"), Amount = c(1, 1, 1, 1, 1, 1, 1, 1, 1, 1, 1, 1), Transaction_Code = c(0, 1, 0, 0, 0, 1, 0, 1, 1, 0, 1, 1)), .Names = c("Customer_ID", "date", "Amount", "Transaction_Code"), row.names = c(NA, -12L ), class = "data.frame")
【问题讨论】:
-
如果您的数据位于 r 中名为
df的变量中,您可以在控制台中输入dput(df),然后将该输出复制并粘贴到您的问题中。
标签: r