【问题标题】:Hierarchical index multi index containing edge values. Rearrange it?包含边缘值的分层索引多索引。重新排列?
【发布时间】:2014-08-04 15:09:10
【问题描述】:

我有 pandas 数据框,其中包含由 networkx 生成的边缘值(中心性、中间性等)。 每行的(多)索引由节点源命名,没有目标。 我拥有的图表不是定向的,因此索引中节点名称的顺序对我来说并不重要。 但是,为了比较和其他操作,我希望这些值具有相同的顺序。

有什么问题?

i1, i2, val1, val2, val3
A,   B,   10,  NaN, 5
B,   A,  NaN,    3,  NaN

我认为有两种可能的方法来解决这个问题: A)通过反转每个值和 NaN 值的索引来镜像值以获取值。 B) 重新排序整个数据帧,以便只出现 A->B 而 B->A 永远不会出现。

一)

i1, i2, val1, val2, val3
A,   B,   10,   3,  5
B,   A,   10,   3,  5

B)

i1, i2, val1, val2, val3
A,   B,   10,  3,  5

【问题讨论】:

    标签: python pandas pivot transform networkx


    【解决方案1】:

    我会使用解决方案 B,因为如果您不关心边缘方向并且将行视为同一事物,则没有理由重复数据。

    首先使用以下方法将您的索引合并到一个索引中

    uniques = df[['i1','i2']].apply(lambda x:frozenset(x),axis=1)
    

    然后只需按新索引分组并将值合并在一起...

    df.groupby(uniques).sum()
    

    输出

    In [133]: df.groupby(uniques).sum()
    Out[133]:
            val1  val2  val3
    (A, B)    10     3     5
    

    【讨论】:

      猜你喜欢
      • 2018-10-28
      • 1970-01-01
      • 1970-01-01
      • 2021-02-19
      • 2021-05-12
      • 2017-10-04
      • 1970-01-01
      • 1970-01-01
      • 2014-01-22
      相关资源
      最近更新 更多