【问题标题】:Operating with two panel dataset with same dates使用两个具有相同日期的面板数据集进行操作
【发布时间】:2020-10-30 12:44:13
【问题描述】:

我正在尝试操作两个填充的数据集:

  • 728 行和 365 列。数据是一年中每天测量的平均每日温度。
  • 938 行和 365 列。数据是一年中每天测量的平均每日温度

数据集 1 看起来像这样

FUA_CODE               01-01-2018   02-01-2018 ...

IT001L1  --> Milano     290.02020    289.1114   ...
IT002L3  --> Roma       281.20203    288.1235   ...
IT003L4  --> Napoli     287.03030    287.3121   ...
...

数据集 2 看起来像这样

URAU_CODE     FUA_CODE                         01-01-2018   02-01-2018 ...

IT001C1       IT001L1 --> Milano                  A             B       ...
IT002C1       IT001L1 --> town outside Milano    ...           ...      ...
IT003C1       IT001L1 --> town2 outside Milano   ...           ...       ...
IT004C1       IT002L3 --> Roma                    C             D
IT005C1       IT002L3 --> town outside Roma      ...           ...
IT006C1       IT002L3 --> town2 outside Roma     ...           ...
IT007C1       IT003L4 --> Napoli                  E             F
IT008C1       IT003L4 --> town outside Napoli    ...           ...
IT009C1       IT003L4 --> town2 outside Napoli   ...           ...
              ...

我的任务是合并这两个数据集,并计算每天一个城市(例如米兰)的温度与另一个数据集中同一城市的温度之间的差异。

理想情况下,结果应该是这样的

FUA_CODE                   01-01-2018        02-01-2018      ...

IT001L1  --> Milano     290.02020  -  A       289.1114 - B   ...
IT002L3  --> Roma       281.20203  -  C       288.1235 - D   ...
IT003L4  --> Napoli     287.03030  -  E       287.3121 - F   ...
...

我可以使用哪些功能?

非常感谢

【问题讨论】:

标签: r merge rbind cbind


【解决方案1】:

您可以先加入df,然后使用summarise计算值。

你可以看到here加入dataframe,here计算它

【讨论】:

  • 好的,谢谢。最后,我如何克服在第二个数据集中有更多人使用相同代码的事实?当我使用summarise 时,我只想用“Milano”减去“Milano”,而不是用相同代码的所有城市减去“Milano”。
  • 我认为您应该多制作 1 列作为标识符,并从 fua_code 列中提取 IT001L1 --> Milano。然后你可以使用group_bysummarise
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2010-10-03
  • 2019-04-02
相关资源
最近更新 更多