【问题标题】:How to add text to bar chart in ggplot如何在ggplot中将文本添加到条形图
【发布时间】:2017-10-23 11:52:23
【问题描述】:

我意识到这个问题已经有多个实例,但没有一个能真正为我提供答案。所以我得到了这个(已经融化的)数据框:

df <-data.frame(
     Var1 = c("Inschrijvingen", "BSA", "Inschrijvingen", "BSA"),
     Var2 = c("Totaal","Totaal", "OD_en_MD", "OD_en_MD"),
     Value = c(262, 190, 81, 69)
)

请注意,这只是数据框的一小部分,我有很多类似的数据框。我通过以下方式制作堆叠条形图:

ggplot(df, aes(Var2, as.numeric(as.character(value)), fill=Var1))+ 
  geom_bar(position="identity", stat="identity") +
  scale_alpha_manual(values=c(.6,.8)) + 
  ggtitle(names(df)) + labs(x="", y="Aantal") + 
  scale_colour_brewer(palette = "Set2") +
  scale_fill_discrete("BSA Resultaten", labels=c("BSA niet behaald", "BSA behaald"))

这给了我以下条形图:

现在我想在条形图的蓝色部分添加百分比。红色部分是订阅者的总数,蓝色部分是通过的数量。所以在我的例子中,这些百分比应该变成

df$Value[2]*100/df$Value[1]
df$Value[4]*100/df$Value[3]

由于我有大量这些数据框,我真的不想手动执行。我在stackoverflow上看到了一些例子,其中文本和百分比计算都在ggplot中实现,百分比是在使用ggplot之前计算的,但恐怕我的数据准备不是那么好很容易。

我尝试过的事情:

#ddply, to add a column with percentages:
ddply(df2, .(Var2), transform, percent=value*100/value)

这里的问题当然是我的百分比计算。如何让 ddply 选择并乘以正确的值?这首先是正确的方法吗?

   #Calculating percentages before melting the data frame, which gives me the (molten) data frame:
    df2 <- data.frame( 
      Var1 =c("Inschrijvingen", "BSA","Percentage","Inschrijvingen", 
            "BSA","Percentage"),
      Var2 =c("Totaal","Totaal","Totaal","OD_en_MD","OD_en_MD","OD_en_MD"),
      Value = c(262,190,72.5,81,69,85.2)
)

这里的问题是我不知道如何在没有绘制百分比的情况下将其输入ggplot。我想我应该将值 PercentageVar1 分开,但我无法做到这一点。

任何帮助将不胜感激!

【问题讨论】:

    标签: r ggplot2 tidyr


    【解决方案1】:
    library(dplyr)
    df <- df %>%
      group_by(Var2) %>%
      mutate(Max = max(Value), Min = min(Value), Per = round(Min*100/Max, 2))%>%
      arrange(Var2)
    
    ggplot(df, aes(Var2, as.numeric(as.character(Value)), fill=Var1))+ 
      geom_bar(position="identity", stat="identity") +
      scale_alpha_manual(values=c(.6,.8)) + 
      ggtitle(names(df)) + labs(x="", y="Aantal") + 
      scale_colour_brewer(palette = "Set2") +
      scale_fill_discrete("BSA Resultaten", labels=c("BSA niet behaald", "BSA behaald"))+
      annotate("text", x = 1:length(unique(df$Var2)), y=rep(min((unique(df$Max)-unique(df$Min))),2), label = unique(df$Per))
    

    【讨论】:

    • 有没有办法让你创建的 Max-column 成为 Var2 中所有相等值的最大值? Max 将变为:c(262, 262, 81, 81)。 Min-column 也需要这样做,现在它们都是分别仅包含 262 和 69 的列。
    • 抱歉,我没有发现问题。你能说得更准确点吗?
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2019-06-21
    • 2023-01-27
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-12-02
    • 1970-01-01
    相关资源
    最近更新 更多