【发布时间】:2019-12-20 14:41:16
【问题描述】:
我将遍历包含不同球员棒球统计数据的大量数据框列表。该数据按年份编制索引。我想做的是组年,同时保持工资不变并增加 WAR。另外,我希望删除不是单年的行。在我的数据集中,这些条目是字符串。
分组
for x in clean_stats_list:
x.groupby("Year")
消除行
for x in clean_stats_list:
for i in x['Year']:
if len(i) > 4:
x['Year'][i].drop()
WAR Year Salary
0 1.4 2008 $390,000
1 0.9 2009 $418,000
2 2.4 2010 $445,000
3 3.6 2011 $3,400,000
4 5.2 2012 $5,400,000
5 1.3 2013 $7,400,000
6 6.8 2014 $10,000,000
7 3.8 2015 $10,000,000
9 0.2 2015 $10,000,000
11 5.5 2016 $15,833,333
12 2.0 2017 $21,833,333
13 1.3 2018 $21,833,333
14 34.3 11 Seasons $96,952,999
16 25.4 CIN (8 yrs) $37,453,000
17 8.8 SFG (3 yrs) $59,499,999
这是我期望达到的目标:
WAR Year Salary
0 1.4 2008 $390,000
1 0.9 2009 $418,000
2 2.4 2010 $445,000
3 3.6 2011 $3,400,000
4 5.2 2012 $5,400,000
5 1.3 2013 $7,400,000
6 6.8 2014 $10,000,000
7 4.0 2015 $10,000,000
11 5.5 2016 $15,833,333
12 2.0 2017 $21,833,333
13 1.3 2018 $21,833,333
【问题讨论】:
-
以正确的格式提供数据帧的 sn-p 和预期输出(使用 HTML sn-p)。那个数据框现在的样子是不可读的。
标签: python python-3.x pandas