【发布时间】:2019-08-24 10:02:23
【问题描述】:
我有一个包含两列的大型数据框(3M 行):key 和 value,我想创建一个向量列表(或任何类似的数据结构),其中包含与不同数量一样多的元素value,使得列表的元素 k 是 key 的向量,其 value 是 k。
# original dataframe:
df
# key value
# 4 a
# 2 a
# 3 k
# 12 a
# expected output:
list
# $`a`
# [1] 4 2 12
#
# $`k`
# [1] 3
我尝试了一个循环,但它非常慢(处理 1M 行需要 6 个小时,我将它停在那里)。有没有更有效的方法?
【问题讨论】:
-
现在好点了吗?
-
好的,谢谢。在基础 R 中,您可以只使用
unstack(df) -
太棒了!这正是我想要的,在 15 秒内!非常感谢,我认为您可以发表评论作为答案。
-
实际上,这已经被问过,所以我将它标记为原始帖子的副本,但我很高兴它对你有用。