【问题标题】:How to compare two different data frames in pandas?如何比较熊猫中的两个不同数据框?
【发布时间】:2017-05-10 02:28:57
【问题描述】:

数据框在任何方面都不相似。它们没有相同的值。我希望能够将一个 df 中的一列与另一列中的另一列进行比较并绘制图表。例如,一个 df 有一个名为“官方贫困总数”的列,另一个 df 有一个名为“暴力犯罪率”的列。我希望能够比较这两者。

我试过 df['Offical Poverty_Total'].append(crime['暴力犯罪']) 但这不是我想要的。为简单起见,我希望有一个包含两列的新表并能够分析新表。

【问题讨论】:

  • 比较是什么意思? “比较”有很多不同的含义。
  • 好的。为简单起见,我想创建一个新表,其中包含一个 df 的一列和另一个 df 的另一列。
  • df['Violent crime'] = crime['Violent crime'] 不做吗?

标签: python-2.7 pandas dataframe compare


【解决方案1】:

你在寻找

pd.concat((df['Offical Poverty_Total'], crime['Violent crime']), axis = 1)

这将对齐它们的索引,因此如果您更改了数据帧的行顺序并希望按照您看到它们的顺序将它们粘合在一起,请执行

pd.concat((df['Offical Poverty_Total'], crime['Violent crime']), axis = 1, ignore_index = True)

【讨论】:

  • 好的,谢谢!当我尝试这个时,它会显示“RecursionError:超出最大递归深度”。有没有办法解决这个问题?
  • 谢谢!有效!我在 pandas 中重新启动了内核,它运行良好。不知道为什么一开始会出现错误,但非常感谢!
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2019-12-13
相关资源
最近更新 更多