【发布时间】:2017-12-24 06:58:25
【问题描述】:
我有一个如下所示的数据框。不过,我想折叠它,以便每个唯一坐标都是其 SubID 的列表。
subID latlon
1 S20298920 29.2178694, -94.9342990
2 S35629295 26.7063982, -80.7168961
3 S35844314 26.7063982, -80.7168961
4 S35833936 26.6836236, -80.3512144
7 S30634757 42.4585456, -76.5146989
8 S35834082 26.4330582, -80.9416786
9 S35857972 26.4330582, -80.9416786
10 S35833885 26.7063982, -80.7168961
所以,在这里,我希望 (26.7063982, -80.7168961) 成为包含 (S35629295, S35844314) 的列表,并且 (29.2178694, -94.9342990) 成为仅包含 (S20298920) 的列表。我认为列表是最有意义的。
【问题讨论】:
-
latlon列的类型是什么,或者那里真的有两列? -
要么,要么,实际上。现在它是一个单列,latlon,属于
character,但我也有(未显示)相同的信息分成两列,lat,lon。谢谢。 -
tidyr::nest(df, subID)也许,尽管从技术上讲,这会产生数据框的列表列。仅使用向量,使用 dplyr,df %>% group_by(latlon) %>% summarise_all(list)或在基础中,aggregate(subID ~ latlon, df, list)