【发布时间】:2017-06-11 20:44:28
【问题描述】:
假设我有一个数据集,其中行是人们学习的类别:
attendance <- data.frame(id = c(1, 1, 1, 2, 2),
class = c("Math", "English", "Math", "Reading", "Math"))
I.e.,
id class
1 1 "Math"
2 1 "English"
3 1 "Math"
4 2 "Reading"
5 2 "Math"
我想创建一个新的数据集,其中行是 id,变量是类名,如下所示:
class.names <- names(table(attendance$class))
attedance2 <- matrix(nrow=length(table(attendance$id)),
ncol=length(class.names))
colnames(attedance2) <- class.names
attedance2 <- as.data.frame(attedance2)
attedance2$id <- unique(attendance$id)
I.e.,
English Math Reading id
1 NA NA NA 1
2 NA NA NA 2
我想在 NA 中填写该特定 ID 是否参加了该课程。它可以是是/否、1/0 或类的计数
I.e.,
English Math Reading id
1 "Yes" "Yes" "No" 1
2 "No" "Yes" "Yes" 2
我熟悉 dplyr,所以如果在解决方案中使用它但不是必需的,对我来说会更容易。感谢您的帮助!
【问题讨论】:
-
基本上只是
table(unique(attendance))