【发布时间】:2018-06-29 15:45:53
【问题描述】:
我有一个包含 100000 行的数据集,其中 order_date 显示订单日期,而 user_id 显示用户 ID。我正在尝试创建一个新变量来显示用户在同一天的总订单。我的数据是这样的:
order_date=structure(c(15587, 15647, 15734, 15560, 15599, 15778, 15708,
15520, 15592, 15447, 15718, 15787, 15519, 15486, 15514, 15784,
15619, 15705, 15552, 15734, 15493, 15661, 15563, 15600, 15790,
15485, 15546, 15767, 15704, 15726), class = "Date")
user_id=c(22607, 28275, 32238, 20202, 4391, 7983, 29590, 11820, 22956,
3196, 31125, 11709, 6586, 2920, 9698, 36814, 6954, 30368, 19052,
827, 6599, 517, 8761, 20174, 37367, 11647, 18764, 27271, 30302,
14808)
daten = data.frame(order_date = order_date, user_id = user_id)
我正在使用此代码:
daten<-join(daten, count(daten, c("order_date", "user_id")))
它创建了一个名为“freq”的新变量,它一直工作到今天。现在它不起作用,我收到这样的错误消息:
mutate_impl(.data, dots) 中的错误:
列c("order_date", "user_id") 的长度必须为 100000(行数)或 1,而不是 2
我使用str 检查了这两个变量的结构,它说两者都有 100000 行。
【问题讨论】:
-
什么是
daten? -
我的数据框名称
标签: r data-science