【发布时间】:2019-09-25 01:18:52
【问题描述】:
下面有一个练习任务:
通过按姓名和性别对数据进行分组,计算样本期间的总出生人数。将组分为男性和女性。使用这些子集,选择顶部和底部的 3 个男性和女性名称。在一个表格中报告它们。
所以我有一个包含姓名、性别、出生和年份的 .csv 文件 ([1])。我似乎无法确切地弄清楚如何完成这项任务。
输出:[2]
births
sex year
F 1990 124.598148
1991 121.215316
1992 118.106646
1993 114.475367
1994 113.331661
1995 111.563710
1996 110.258765
1997 107.671846
1998 106.412899
1999 104.643578
2000 102.779761
2001 100.116023
2002 99.283904
2003 99.055598
2004 97.443251
2005 96.216343
2006 94.690833
2007 93.415595
2008 92.263176
2009 90.823585
M 1990 216.417422
1991 209.419977
1992 203.524373
1993 192.999015
1994 188.475200
1995 184.294158
1996 179.760661
1997 174.291755
1998 169.057720
1999 165.296596
2000 162.003634
2001 157.905281
2002 155.438592
2003 154.773933
2004 150.038389
2005 149.376874
2006 146.330312
2007 144.067535
2008 139.294722
2009 136.291111
【问题讨论】:
-
需要输入数据和预期输出数据的片段来帮助您。
-
完成!不确定输出的确切外观。我只需要按照给定的说明进行操作
-
请以文字而非图片的形式提供数据的 sn-p。我们不能用图片创建数据框。
-
完成!对此感到抱歉
-
您想知道每年或您拥有的整个数据集的顶部和底部 3 个男性和女性名称吗?
标签: python pandas csv group-by pivot-table