【发布时间】:2016-06-17 10:37:00
【问题描述】:
我想对以下示例数据集使用 na.omit(数据),但条件是仅当它们存在于“超过 30%”的列中时才删除具有 NA 的行。
数据:
C1 C2 C3 C4 C5
Gene1 0.07 NA 0.05 0.07 0.07
Gene2 0.2 0.18 0.16 0.15 0.15
Gene3 NA 0.93 0.9 NA 0.92
Gene4 0.32 0.05 0.12 0.13 0.05
Gene5 0.44 0.53 0.46 0.03 0.47
Gene6 NA 0.34 NA 0.8 NA
Gene7 0.49 0.55 0.67 0.49 0.89
Gene8 0.25 NA 0.49 NA NA
Gene9 0.1 0.1 0.05 NA 0.09
所以生成的文件应该如下:
C1 C2 C3 C4 C5
Gene1 0.07 NA 0.05 0.07 0.07
Gene2 0.2 0.18 0.16 0.15 0.15
Gene4 0.32 0.05 0.12 0.13 0.05
Gene5 0.44 0.53 0.46 0.03 0.47
Gene7 0.49 0.55 0.67 0.49 0.89
Gene9 0.1 0.1 0.05 NA 0.09
感谢您的帮助!
【问题讨论】:
-
您如何决定要删除哪些
NA值? -
嗨蒂姆,它不依赖于哪个 NA。只有当特定行的 NA 超过 30% 时,才会完全删除该行。
-
你尝试了什么?显示一些代码。