【发布时间】:2019-04-26 00:32:25
【问题描述】:
这是我第一次在这个伟大的社区提出问题。我正在尝试计算 data.frame 上的索引,按行政区或社区显示它们并绘制。哪个代码最适合?
这是我拥有的数据集的示例。 albo, aegy = 蚊子种类, house = 预期的房屋, 计算的房屋指数为(正面房屋数/预期房屋数)*100。阳性房屋是至少发现一只蚊子的房屋(值!= 0) HI = (7/11)*100 = 63.63 总计(11 = 预期房屋数量,7 = 阳性房屋总数)
borough neighborhood concession albo aegyp Total_albo_aegyp
a1 mendong 1 1 5 6
a1 mendong 2 5 2 7
a1 mendong 3 2 1 3
a1 tam tam 4 0 0 0
a2 tam tam 5 4 6 10
a2 obili 6 0 1 1
a2 obili 7 0 0 0
a3 acacia 8 3 7 10
a4 melen 9 1 1 2
a4 melen 10 0 5 5
a4 polytech 11 8 0 10
HIcommune <- concessiondata %>%
group_by(commune) %>%
summarise(
Mean = mean(concessiondata$total_aedes_albo_aegypti!=0),
HIY = sum(concessiondata1$total_aedes_albo_aegypti!=0)/length(concessiondata1$total_aedes_albo_aegypti))
Houseindex_total <- concessiondata1[, Mean := mean(total_aedes_albo_aegypti!=0), by = "commune"]
## This is how the results should look like
borough albo HI aegy HI Total_albo_aegyp_HI
a1 75 75 75
a2 33.33 66.66 66.66
a3 100 100 100
a4 66.66 66.66 100
【问题讨论】:
-
你为什么混合
dplyr和data.table语法?另外,请仔细检查您的代码。您的示例数据没有commune列。最后,您不需要在summarise中为$-index 列。总之,这似乎是理解基本dplyr语法的更多问题。 -
感谢您的发言。当我在我的代码中删除符号 $ 时,一切都和你提到的一样。