【发布时间】:2018-12-02 17:36:05
【问题描述】:
我有一个如下所示的数据框:
Gene.names=c("ESR", "ESR.1", "ESR.2", "ESR.3", "PKB", "PKB.1", "PKB.2", "PKB.3")
mean_0.x = c(3,2,5,9,2,4,6,7)
mean_1.x = c(6,2,5,1,9,1,1,9)
mean_2.x = c(3,2,9,9,6,7,3,3)
mean_0.y = c(1,NA,NA,NA,6,NA,NA,NA)
mean_1.y = c(1,NA,NA,NA,3,NA,NA,NA)
mean_2.y = c(6,NA,NA,NA,4,NA,NA,NA)
df = cbind.data.frame(Gene.names, mean_0.x, mean_1.x, mean_2.x, mean_0.y, mean_1.y, mean_2.y)
我想要的输出:
Gene.names = c("ESR", "ESR.1", "ESR.2", "ESR.3", "PKB", "PKB.1", "PKB.2", "PKB.3")
mean_0_diff = c(3,2,5,9,0.33,0.66,1,1.16)
mean_1_diff = c(6,2,5,1,3,0.33,.0.33,3)
mean_2_diff = c(0.5,0.33,1.5,1.5,1.5,1.75,0.75,0.75)
df_out = cbind.data.frame(Gene.names, mean_0_diff, mean_1_diff, mean_2_diff)
- 我的数据框包含数千行和 >50 列
- 我想划分对应的列,例如
mean_0.x/mean_0.y; mean_1.x/mean_1.y; mean_2.x/mean_2.y;等 - 我想回收 *.y 中的行值,以便在此示例中,mean_0.y 中的值在 mean_0.x 上使用 4 次。但是,在我的真实数据集中,这种“回收”必须发生任何未知次数。
【问题讨论】:
标签: r dataframe dplyr data.table purrr