【问题标题】:Creating custom names for columns based on other column names in pandas dataframe根据熊猫数据框中的其他列名为列创建自定义名称
【发布时间】:2023-01-12 18:49:37
【问题描述】:

我有一个如下所示的数据框:

我正在寻找使用差异创建列或在列之间使用任何其他计算。但是,我希望为该列命名,以反映已完成的操作。对于下面的例子,我发现黑白 Origin 1 和 Dest 1 的区别如下:

如何创建突出显示的那些自定义命名的列,尤其是当我必须创建多个这样的列时。

【问题讨论】:

    标签: python pandas dataframe calculated-columns naming


    【解决方案1】:

    只需遍历它并命名你可以使用 f-string

    for col_a in df.columns:
       for col_b in df.columns:
          if col_a != col_b:
             df[f'{col_a} - {col_b}'] = df['col_a'] - df['col_b']
    

    【讨论】:

      【解决方案2】:

      这很简单。

      让我们定义一个包含两列ab 的数据框:

      df = pd.DataFrame({"a":[1,2,3,4],"b":[4,3,2,1]})
      

      输出:

          a   b
      0   1   4
      1   2   3
      2   3   2
      3   4   1
      

      现在,让我们在两列之间创建上面提到的差异

      df["a-b"] = df["a"] - df["b"]
      

      瞧!现在您有了一个新列。

          a   b   a-b
      0   1   4   -3
      1   2   3   -1
      2   3   2   1
      3   4   1   3
      

      【讨论】:

      • 为 100 个这样的列继续写 df["a-b"] 会很累。因此问题。
      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-02-03
      • 2019-12-09
      • 1970-01-01
      • 1970-01-01
      • 2016-06-24
      • 1970-01-01
      相关资源
      最近更新 更多