【发布时间】:2017-10-19 21:40:37
【问题描述】:
这是一个数据争论的问题,一个查询的问题。我有一个数据集,每一行不代表 1 个样本,但包含一个包含 ID 列表的列。例如,您有 3 列:年龄、性别和 ID。你可以有一行:28, M, 'ID209,ID208'。
有没有简单的方法来扩展这个数据集,使每个 ID 号有一行?我正在使用 R 或 Python。
【问题讨论】:
-
是的,您必须提供数据样本以供我们帮助。如果您使用的是 R,请参阅 here for creating a reproducible example
-
R 解决方案:
library(tidyverse); df %>% mutate(id = stringr::str_split(id, “,”)) %>% unnest(id) -
谢谢,unnest 确实是我一直在寻找的功能!
标签: python r data-science