【发布时间】:2021-10-18 00:49:33
【问题描述】:
我有一个如下所示的数据集:
postcode house_number col2 col3
xxx xxx xxx xxx
xxx xxx xxx xxx
我想通过postcode和house_number对数据进行分组,如果两行有相同的邮政编码和门牌号,则表示它们是相同的属性,那么我想为每个属性构造一个unique_id(在换句话说,对于unique_id,postcode / house_number 必须相同,但 col2 / col3 的值可能不同),例如:
unique_id postcode house_number col2 col3
0 111 222 xxx xxx
0 111 222 xxx xxx
1 xxx xxx xxx xxx
.....
我尝试了new_df = ppd_df.groupby(['postcode','house_number']).reset_index(),但它给了我错误AttributeError: 'DataFrameGroupBy' object has no attribute 'reset_index',我也不知道如何构造列unique_id。有人可以帮忙吗?谢谢。
【问题讨论】:
标签: python pandas dataframe group-by pandas-groupby