【发布时间】:2017-06-06 10:05:55
【问题描述】:
也许我错过了显而易见的事情。
我有一个看起来像这样的熊猫数据框:
id product categories
0 Silmarillion ['Book', 'Fantasy']
1 Headphones ['Electronic', 'Material']
2 Dune ['Book', 'Sci-Fi']
我想使用 groupby 函数来统计类别列中每个元素的出现次数,所以这里的结果是
Book 2
Fantasy 1
Electronic 1
Material 1
Sci-Fi 1
但是,当我尝试使用 groupby 函数时,pandas 会计算整个列表的出现次数,而不是分离其元素。我尝试了多种不同的方法来处理这个问题,使用元组或拆分,但到目前为止我还没有成功。
【问题讨论】:
-
旁白:pandas 目前还不完全支持非标量条目,使用它们时有时会出现神秘的故障。修改框架通常更安全,这样每一行都只包含标量条目。
标签: python python-3.x pandas numpy pandas-groupby