【发布时间】:2021-12-06 16:29:51
【问题描述】:
有一个电影数据集。我想找出每年排名前 3 的类型(当年电影数量最多的类型)。 数据集摘录如下:
year genre imdb_title_id
19 1894 Romance 1
29 1906 Biography 1
31 1906 Crime 1
33 1906 Drama 1
58 1911 Drama 4
73 1911 War 2
52 1911 Adventure 1
60 1911 Fantasy 1
62 1911 History 1
83 1912 Drama 5
87 1912 History 2
79 1912 Biography 1
81 1912 Crime 1
91 1912 Mystery 1
98 1912 War 1
108 1913 Drama 11
106 1913 Crime 4
110 1913 Fantasy 3
102 1913 Adventure 2
113 1913 Horror 2
如何在pandas中进行这种操作?我试过 nlargest 但没有得到正确的结果。 这种情况下的预期输出应该是这样的:
19 1894 Romance 1
29 1906 Biography 1
31 1906 Crime 1
33 1906 Drama 1
58 1911 Drama 4
73 1911 War 2
52 1911 Adventure 1
83 1912 Drama 5
87 1912 History 2
79 1912 Biography 1
108 1913 Drama 11
106 1913 Crime 4
110 1913 Fantasy 3
【问题讨论】:
-
groupby('year')和nlargest(3)提供您想要的输出。您尝试了什么,结果是什么错误?
标签: python pandas data-science