【发布时间】:2021-02-28 22:43:40
【问题描述】:
我得到了这个公司数据集,我已经“完成了面板”,所以只要定量变量(销售额、工资)为 0,公司就会关闭。 NA 代表我已经完成了面板,这意味着所有公司的年份都相同,但 NA 表示该公司之前(或之后)不存在
我想根据每个标准为公司的第一次关闭做一个计数器。
所以我的数据看起来像这样:
Year Firm sales wages
2014 A 12 4
2015 A 8 3
2016 A 0 0
2017 A NA NA
2018 A NA NA
2014 B NA NA
2015 B 8 3
2016 B 4 2
2017 B 9 5
2018 B 8 6
2014 C 9 5
2015 C 7 6
2016 C 0 0
2017 C 0 0
2018 C 0 0
2014 D 9 5
2015 D 7 6
2016 D 8 0
2017 D 0 4
2018 D NA NA
而想要的结果是这样的:
Year Firm sales wages Closure sales Closure Wages Closure (both)
2014 A 12 4 0 0 0
2015 A 8 3 0 0 0
2016 A 0 0 1 1 1 # Firm closed here
2017 A NA NA 2 2 2 # Doesn't appear on the original df but it's closed
2018 A NA NA 3 3 3 # Same here
2014 B NA NA 0 0 0 # Firm has not opened yet
2015 B NA NA 0 0 0 #Same here
2016 B 4 2 0 0 0
2017 B 9 5 0 0 0
2018 B 8 6 0 0 0
2014 C 9 5 0 0 0
2015 C 7 6 0 0 0
2016 C 0 0 1 1 1 #Firm closed but still have obligations, so it appears
2017 C 0 0 2 2 2 # Same
2018 C 0 0 3 3 3 # Same
2014 D 9 5 0 0 0
2015 D 7 6 0 0 0
2016 D 8 0 0 1 1 #Firm closed by wages criteria, but somehow still sells
2017 D 0 4 1 2 2 #Firm doesn't sell anything, but pays wages.
2018 D NA NA 2 3 3 #Firm doesn't have any obligations left.
我怎样才能做到这一点?
提前致谢。
【问题讨论】:
-
为什么公司 = B 的所有关闭销售额和关闭工资都是 0。
标签: r database dataframe dplyr tidyverse