【问题标题】:'Join columns must be present in data' error“连接列必须存在于数据中”错误
【发布时间】:2021-09-02 12:25:57
【问题描述】:

我遇到了这个奇怪的问题。

以下代码有效:


Jakarta_Covid <- left_join(DKI_Jakarta, Covid_DF,
                          by = c("Sub_District" = "Sub_District"))

但是下面的代码块给了我'联接列必须存在于数据中。 x Sub_District 的问题。

Jakarta_Death <- Covid_DF %>%
  inner_join(DKI_Jakarta, by=c("Sub_District"="Sub_District")) %>%
  group_by(Sub_District, Month) %>%
  summarise(`Covid Death Per 10,000 Population` = (((sum(Death))/(Total_Population))*10000))

Jakarta_Death  <- Jakarta_Death %>% left_join(DKI_Jakarta, 
                       by=c("Sub_District"="Sub_District"))

如何从两个 DF 计算“每 10,000 人的 Covid 死亡人数”,我需要 DKI_Jakarta 中的 Geometry 列稍后绘制成地图。

【问题讨论】:

  • 请修剪您的代码,以便更容易找到您的问题。请按照以下指南创建minimal reproducible example
  • 我不知道 "trim your code",但请务必向 MWE 提供示例数据。另外,哪个连接产生了错误?
  • 没有数据,很难知道,但我会检查一下,在运行以summarise(Covid Death Per 10,000 Population 结尾的行之后......`有一个名为 Sub_District 在 Jakarta_Death。您可能需要加入名为“Covid Death per ...”的专栏,例如by= c("Sub_District" = "Covid Death per ...")

标签: r dataframe left-join


【解决方案1】:

left_join(DKI_Jakarta, Covid_DF, by = c("Sub_District") 如果您在两个表中具有相同的列名,只需在 by=() 中留下一个

【讨论】:

    猜你喜欢
    • 2022-01-11
    • 1970-01-01
    • 2020-01-30
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-01-21
    • 2021-12-25
    相关资源
    最近更新 更多