【发布时间】:2015-03-18 15:24:03
【问题描述】:
我有两个文件(健康与癌症)包含转座元素类和子类(两列),但一个有 71602 行,另一个有 72500,我试图将它们作为数据框放在一个文件中以执行 Fisher 测试并查看是否有一个类别在癌症中比在健康组织中更重要,但还没有设法得到它。 有谁知道如何获取一个文件并执行 Fisher 测试?
【问题讨论】:
标签: r
我有两个文件(健康与癌症)包含转座元素类和子类(两列),但一个有 71602 行,另一个有 72500,我试图将它们作为数据框放在一个文件中以执行 Fisher 测试并查看是否有一个类别在癌症中比在健康组织中更重要,但还没有设法得到它。 有谁知道如何获取一个文件并执行 Fisher 测试?
【问题讨论】:
标签: r
Fisher 检验的输入是一个 2x2 列联表。您想要的内容分别在您的两个文件中读取,然后从中生成列联表。您不需要将两个文件合并到一个数据框中。例如,你可以这样做
df1<-data.frame(health=rep("healthy", 5), TE=sample(c("A", "B"), 5, replace=T))
df2<-data.frame(health=rep("cancer", 7), TE=sample(c("A", "B"), 7, replace=T))
ctable<-matrix(c(sum(df1$TE=='A'), sum(df1$TE=='B'), sum(df2$TE=='A'), sum(df2$TE=='B')), nrow=2, ncol=2, dimnames=list(c("A", "B"), c("Healthy", "Cancer")))
ctable
fisher.test(ctable)
【讨论】: