【发布时间】:2021-09-07 04:26:04
【问题描述】:
要计算数据集中的唯一用户,可以使用以下代码:
library(tidyverse)
library(igraph)
graph.data.frame(dat) %>%
components() %>%
pluck(membership) %>%
stack() %>%
set_names(c('GRP', 'user_id')) %>%
right_join(dat %>% mutate(user_id = as.factor(user_id)), by = c('user_id'))
我想知道是否有办法扩展/修改那段代码,所以我们可以对两个以上的字段执行相同的过程。例如,对于以下数据:
dat <- data.frame(user_id = c(101,102,102,103,103,106, 107, 111, 112),
phone_number = c(4030201, 4030201, 4030202, 4030202, 4030203, 4030204, 4030205, 4030203, 4030206),
email = c("a@gmail.com", "b@gmail.com", "c@gmail.com", "d@gmail.com", "e@gmail.com", "f@gmail.com", "g@gmail.com", "h@gmail.com", "a@gmail.com"))
关于如何修改超过 2 个字段的代码有什么想法吗?谢谢!
【问题讨论】: