【发布时间】:2013-03-29 20:10:27
【问题描述】:
基本上,我有一个基因数据集,其中行是基因,列是蛋白质折叠的连续时间点。我需要一个函数来过滤整个数据集中具有某个阈值的基因,而不仅仅是某些向量。例如:
alpha98 alpha105 alpha112 alpha119
YAL002W 0.22 0.58 -0.36 0.13
YAL003W 0.05 0.55 -0.08 0.33
任何帮助都会很棒。
【问题讨论】:
-
df[df$alpha98>threshold,] ?
-
您希望阈值应用于所有基因,还是仅应用于特定种类?如果基因超过阈值,您是要选择整行还是只选择特定值?
-
谢谢,朱巴。我想知道是否有办法对整个数据集执行此操作,而不仅仅是列。我会指定这个。
-
Ricardo,感谢您的建议让我指定。我正在寻找一个适用于整个数据集的函数,而不仅仅是一个特定的向量。
-
@user2105555,然后正如朱巴指出的那样,您可以简单地使用
myDF[myDF>threshold](不指定列)