【发布时间】:2020-03-21 10:13:30
【问题描述】:
我对 R 非常熟悉,但在 for 循环方面完全是新手。
基本上,我对 1977 年至 2015 年的当前人口调查数据进行了大约 5000 万次观察,我希望:
A)。按年份对所有数据进行子集
B)。用多个新变量改变所有子集的 dfs
C)。 group_by 州 ID,并总结该州在该特定年份的几个变量的平均值
D)。将我的新汇总数据重新组合在一起
手动执行此操作没有任何问题,但它非常重复,我希望使我的代码更高效。这是我如何手动实现它的示例:
FinalCPS<- load.csv("CPS")
CPS1977 <- FinalCPS %>% filter(YEAR==1977)
CPS1977 <- CPS1977 %>% mutate(newvar = ..)
CPS1977 <- CPS1977 %>% group_by(STATEID) %>% summarise(mean(var1),mean(var1))
欢迎任何帮助。
【问题讨论】:
-
您还应该按
Year分组,而不是一一过滤。CPS1977 %>% group_by(STATEID, YEAR) %>% summarise(mn = mean(var1)
标签: r