【发布时间】:2014-12-21 06:51:20
【问题描述】:
我有一个包含 32000 行和 60 列的大文本文件。 (行是基因,列是样本,每个单元格包含每个样本中每个基因的值)。我想删除那些大于 10 乘以 2 且小于 2 的基因(行)。这意味着例如,如果第一行在至少 10 个样本(列)中具有 2 或小于 2(基因值)我想要去掉它。我认为首先它应该遍历行以找到那些具有 2 或小于 2 的列并为每一行计算它们。如果计数至少为 10,则该行将被删除。
【问题讨论】:
-
你测试过
R代码吗? -
编辑后的数字是多少?
-
抱歉,没有正确理解问题。