【发布时间】:2021-01-28 17:07:38
【问题描述】:
我正在尝试合并两个具有不同来源失业率的数据集,第一个数据集的结构如下:
它有 30 多个变量,但我仅将其作为示例列出。此外,每次观测只测量一年,埃及是 2005 年。
year country Gender Unemployment
2005 EGY Female 7.6
2005 EGY Male 9.2
2005 EGY Total .
2006 EGY Female 7.6
2006 EGY Male 9
2006 EGY Total .
第二个的结构如下,但它来自年度调查,因此每个国家/地区每年都有三个条目(总计,男性,女性)。从 1995 年到 2019 年,每个国家/地区都有。
country Gender year Unemployment
EGY Total 2005 12
EGY Male 2005 7
EGY Female 2005 17.5
因此,我尝试使用 1:1 和 1:m 合并来合并两个数据集,对于这两个数据集,我得到: “变量国家年份不能唯一标识主数据中的观察结果”
但是,合并使用 m:m,如下所示,
merge m:m country year using "Documents\LMI.dta"
感谢尼克的建议,我合并了三元组:
merge 1:1 country year Gender cusing "Documents\LMI.dta"
而且效果很好!
【问题讨论】: