【发布时间】:2021-10-04 07:42:59
【问题描述】:
这是我现在正在使用的数据框:
| Season | Team | W | L | W/L% | Coaches | |
|---|---|---|---|---|---|---|
| 1 | 2020-21 | Atlanta Hawks* | 41 | 31 | 0.569 | L. Pierce (14-20) N. McMillan (27-11) |
| 2 | 2019-20 | Atlanta Hawks | 20 | 47 | 0.299 | L. Pierce (20-47) |
| 3 | 2018-19 | Atlanta Hawks | 29 | 53 | 0.354 | L. Pierce (29-53) |
| 4 | 2017-18 | Atlanta Hawks | 24 | 58 | 0.293 | M. Budenholzer (24-58) |
| 5 | 2016-17 | Atlanta Hawks* | 43 | 39 | 0.524 | M. Budenholzer (43-39) |
| 6 | 2015-16 | Atlanta Hawks* | 48 | 34 | 0.585 | M. Budenholzer (48-34) |
| 7 | 2014-15 | Atlanta Hawks* | 60 | 22 | 0.732 | M. Budenholzer (60-22) |
| 8 | 2013-14 | Atlanta Hawks* | 38 | 44 | 0.463 | M. Budenholzer (38-44) |
| 9 | 2012-13 | Atlanta Hawks* | 44 | 38 | 0.537 | L. Drew (44-38) |
| 10 | 2011-12 | Atlanta Hawks* | 40 | 26 | 0.606 | L. Drew (40-26) |
| 11 | 2010-11 | Atlanta Hawks* | 44 | 38 | 0.537 | L. Drew (44-38) |
| 12 | 2009-10 | Atlanta Hawks* | 53 | 29 | 0.646 | M. Woodson (53-29) |
我基本上只想有教练的名字从一年到下一年不同的行。例如,我会保留第 4 行,因为它紧邻的第 3 行在“教练”列下具有不同的名称,但我会删除第 5、6 和 7 行,因为“教练”列中的名称与所有三行。但是,我想保留第 8 行,因为第 9 行(相邻行)在“教练”中有不同的名称。
我通过读取 csv 文件得到了这个数据框
df = pd.read_csv("hawks.csv")
我想我应该打电话给df.iloc,但我不知道如何遍历每一行并比较列中的值。到目前为止,我只设法在“教练”列中打印字符串值,如下所示:
coaches = df.iloc[0:, 7]
for name in coaches:
print(name)
但我想知道当我遍历每一行时如何获取存储在“Coachs”列中的值(然后删除不符合我正在寻找的标准的行)。非常感谢!
【问题讨论】:
标签: python pandas dataframe loops jupyter-notebook