【发布时间】:2017-05-15 12:39:16
【问题描述】:
我是一名生物学专业的学生,在我们的实验室中,我们正在小鼠身上测试某种药物。正常状态下,我们有很多组生物复制的基因表达数据:
gene replicate 1 replicate2
gene1 -0.842138 -0.701153
gene2 -0.796896 -0.725085
gene3 -0.835920 -0.707572
gene5 -0.702721 -0.724579
gene6 -0.815476 -0.737112
....
gene 20000
each dot represent a gene
给它们喂药后,我们有一个新的基因表达数据: after medicine treatment
我的问题是,我如何才能将那些真正受影响的基因与那些只是生物学差异(重复之间的差异)分开?
我是机器学习的新手,我相信监督学习应该是我的选择,对吧?训练数据是我的复制数据,然后我可以测试药物治疗后的每个基因是否可以落入复制定义的“耐受区”。但我不确定我应该使用哪种方法。提前感谢任何指导。
【问题讨论】:
-
天哪。我需要一分钟..
标签: python r machine-learning