【问题标题】:Checking for unique maps in csv file using pandas python使用 pandas python 检查 csv 文件中的唯一地图
【发布时间】:2018-04-16 10:50:05
【问题描述】:

我附上一个 excel 文件的屏幕截图。它在三列中包含 x、y 和 z 值。我要检查的是存在多少功能循环,意思是“(x>x),(x>y,y>x),(x>y,x>y1),(x>y,y>x1) ”。我想编写一个示例代码来检查这个 excel 文件中存在的功能循环的数量。我编写了一个示例代码来检查 (x>x),但我无法为其他循环编写代码。任何帮助将不胜感激。

x 的含义>x 是第 1 列和第 2 列中的两个元素相等

(x>y, y>x) 的意思是第 1 列中的元素映射到第 2 列中的元素,第 2 列中的相同元素映射到第 1 列中的相同元素

import pandas as pd
df = pd.read_csv('/home/amit/Desktop/playing_with_pandas.csv')
xy_data = df.iloc[:,0:2]
x>x = xy_data[xy_data.nunique(1).eq(1)]
print("the number of x>x are",x>x)

Screen shot of csv

【问题讨论】:

  • “(x>y,x>y1)”是什么意思?
  • 表示同一个x值有不同的y值。例如:如果您查看屏幕截图,那么您可以看到 x=1 的值,它具有三个不同的 y 值,2、9、17

标签: python pandas logic


【解决方案1】:

x>x

(df.x == df.y).sum()

x>y, y>x

df.duplicated().sum()

x>y, x>y1

(df.y.groupby(df.x).nunique() > 1).sum()

x>y, x1>y

(df.x.groupby(df.y).nunique() > 1).sum()

【讨论】:

  • 如果我想在每种情况下计算平均值和标准差怎么办。我尝试使用 df.mean()。它不起作用
猜你喜欢
  • 1970-01-01
  • 2019-04-02
  • 2019-08-27
  • 2023-03-30
  • 2015-04-29
  • 2015-03-15
  • 1970-01-01
  • 2015-02-18
  • 2013-07-23
相关资源
最近更新 更多