【发布时间】:2018-07-15 22:19:17
【问题描述】:
我有一个数据框 - df - 包含基因组数据。最后的 col 有两个字母的变体。
id crm pos allele
160841 rs2237282 11 1273948 AG
160842 rs6417577 11 1276796 AC
165677 rs2151342 11 1199626 GT
165678 rs2749240 11 1258025 AG
我想把最后的一列分成两列,每列一个字母
id crm pos allele allele2
160841 rs2237282 11 1273948 A G
160842 rs6417577 11 1276796 A C
165677 rs2151342 11 1199626 G T
165678 rs2749240 11 1258025 A G
我在 RStudio 1.1.419、R 3.4.3 中使用 dplyr 和 tidyr 尝试过,但没有成功:
- 分离(df, allele, into=c("allele", "allele2"))
- 分离(df, allele, into=c("allele", "allele2"), sep="")
- 分离(df, allele, into=c("allele", "allele2"), sep="\c")
- separate(df, allele, into=c("allele", "allele2"), sep=".")
- 分离(df, allele, into=c("allele", "allele2"), sep=.)
- 分离(df, allele, into=c("allele", "allele2"), sep=\c)
我如何得到想要的拆分?
【问题讨论】:
标签: r data-science tidyr