【发布时间】:2020-11-06 14:04:16
【问题描述】:
我从 pdf 中提取数据并遇到了一个小问题。一些单元格被分隔成两行,以便数据在某些单元格中具有 NA,而在其他单元格中具有值。这些值我想简单地合并到上面的单元格中。
有趣的是,我要合并其他行的每条“真实”行都以相同的符号开头,即“§”。
我有大约 1000 个观察结果,所以自动化解决方案会很棒
first <- c("§", "3", "4")
second <- c(NA, "2", NA)
third <- c("§", "2", 5)
fourth <- c(NA, "2", "3")
... and so on
df <- as.data.frame(rbind(first, second, third, fourth))
expected output:
first_e <- c("§", "32", "4")
second_e <- c "§", "22", "53")
df_e <- as.data.frame(rbind(first_e, second_e))
如果有人有想法,那就太棒了(:
柏林最佳
【问题讨论】:
-
你能分享你的预期输出吗?
-
如果我理解正确的话,并不总是有第二行 - 因此很难区分什么定义了“第二行”和什么是“第一行”。这意味着您必须确定,“第二”行总是至少有一个 NA,而“第一”行永远不会有任何 NA。这将是“自动化”的最低假设
-
嗨,总是有第二行 - 但是,有些是空的,有些是有值的。
-
预期输出:``` 输出
-
另一种可能性是所有“实际”行都以相同的符号开头,即“§”。我编辑了示例