【发布时间】:2018-10-06 14:42:36
【问题描述】:
我有一个文件,其中包含与 ID 的每个唯一值相关联的 depression 值。名为 HAVE 的数据框如下所示:
id depression friendid_A friendid_B friendid_C friendid_D
1 1.0 NA 3 6 5
2 0.6 6 4 NA NA
3 0.0 1 4 5 NA
4 1.8 1 3 NA 2
5 1.7 NA NA NA NA
6 0.3 2 3 NA NA
我想添加一个变量 depression_sum 来查找观察中列出的每个 ID 的 depression 值,并将它们相加。例如,第一个观察包括其各种 friendid_n 变量的 ID 3、6 和 5。这三个 ID 的 depression 值分别为 0.0、0.3 和 1.7。因此,此观察的 depression_sum 将为 2.0。
下面是我要创建的名为 WANT 的数据框:
id depression friendid_A friendid_B friendid_C friendid_D depression_sum
1 1.0 NA 3 6 5 2.0
2 0.6 6 4 NA NA 2.1
3 0.0 1 4 5 NA 4.5
4 1.8 1 3 NA 2 1.6
5 1.7 NA NA NA NA NA
6 0.3 2 3 NA NA 0.6
有没有办法有效地查找这些值并创建一个包含它们总和的变量?
【问题讨论】:
-
您可能希望将列重命名为
friendid_a, _b, _c, _d以避免混淆 -
刚刚做了 - 谢谢!
标签: arrays r dataframe lookup data-manipulation