【问题标题】:Combine columns in matrix having same column name合并矩阵中具有相同列名的列
【发布时间】:2012-07-17 06:17:07
【问题描述】:

我有一个矩阵,其中的列与字符列名重复。

set.seed(1)
m <- matrix(sample(1:10,12,replace=TRUE), nrow = 3, ncol = 4, byrow = TRUE,
       dimnames = list(c("s1", "s2", "s3"),c("x", "y","x","y")))

m
   x y  x  y
s1 3 4  6 10
s2 3 9 10  7
s3 7 1  3  2

我需要将具有相同列名的所有列汇总为一列,即

m <- matrix(c(9,14,13,16,10,3), nrow = 3, ncol = , byrow = TRUE,dimnames = list(c("s1", "s2", "s3"),c("x", "y")))

    x  y
s1  9 14
s2 13 16
s3 10  3

我玩过聚合函数中的简单求和,但没有运气。有什么建议吗?谢谢。

【问题讨论】:

  • 建议 #1:提供最小的reproducible example
  • 我可以用多种方式解释您的问题。这让人无法理解。请发布示例数据和预期结果。
  • 好的,现在我有了你的样本数据。这是一个好的开始。预期结果如何?
  • 我刚刚添加了预期的结果。谢谢。
  • 您必须再进行一次编辑。由于您使用sample,因此您将随机性引入样本数据。这使得它无法重现。要解决此问题,您需要在第一个示例之前添加 set.seed(1) 或类似名称。我添加了这个,让你开始。您需要使用这组特定数据更新预期结果。

标签: r aggregate


【解决方案1】:

好吧,这个解决方案不会因为代码的透明性而赢得任何奖项,但我更喜欢它:

nms <- colnames(m)
m %*% sapply(unique(nms),"==", nms)
#     x  y
# s1  9 14
# s2 13 16
# s3 10  3

它的工作原理是构造一个矩阵,该矩阵形成m 的列的适当线性组合。要查看它是如何工作的,请将第二行分成两个分量矩阵,使用 %*% 将它们相乘,如下所示:

 -          -      -   -
|  3 4  6 10 |    | 1 0 |
|  3 9 10  7 |    | 0 1 |
|  7 1  3  2 |    | 1 0 |
 -          -     | 0 1 |
                   -   -

【讨论】:

  • +1 因为经过我所有的努力来弄清楚 OP 想要什么,你仍然设法窃取它 :-) 另外,我不知道你做了什么!
  • 谢谢。它工作得很好,但我现在不完全明白为什么,但会及时把它拆开。
  • @Elizabeth -- 我只是添加了一些解释。在那短短的代码行中有很多 R 技巧;它可能不清楚,但(出于同样的原因)它可能会奖励你给予它的任何关注。
  • 太棒了 - 我刚刚也为稀疏矩阵对象工作,使用稀疏逻辑矩阵乘以 dgCMatrix。
【解决方案2】:
nms <- colnames(m)
sapply(unique(nms), function(i)rowSums(m[, nms==i]))

   x  y
s1  9 14
s2 13 16
s3 10  3

【讨论】:

  • 感谢您帮助我澄清问题以及您的回答!
  • +1 我确实觉得自己像个小偷,如果我没有躲在某种防火墙后面,把我当机器人一样对待,不让我做任何 cmet一点也不。还是很震惊我用我奇怪的小代码行接受了!
  • @JoshO'Brien 恐怕你没有通过图灵测试。只有机器人才会想出这样一个模糊的答案,然后编出这样一个不太可能的借口。
猜你喜欢
  • 2021-02-24
  • 1970-01-01
  • 2014-01-18
  • 1970-01-01
  • 1970-01-01
  • 2017-04-22
  • 2020-06-18
  • 1970-01-01
  • 2022-11-10
相关资源
最近更新 更多