【发布时间】:2023-01-19 04:30:23
【问题描述】:
我有一个像这样的数据框:
| id | country | city | amount | duplicated |
|---|---|---|---|---|
| 1 | France | Paris | 200 | 1 |
| 2 | France | Paris | 200 | 1 |
| 3 | France | Lyon | 50 | 2 |
| 4 | France | Lyon | 50 | 2 |
| 5 | France | Lyon | 50 | 2 |
我想重复存储每个不同值的列表,例如:
列表 1
[
{
"id": 1,
"country": "France",
"city": "Paris",
"amount": 200,
},
{
"id": 2,
"country": "France",
"city": "Paris",
"amount": 200,
}
]
清单 2
[
{
"id": 3,
"country": "France",
"city": "Lyon",
"amount": 50,
},
{
"id": 4,
"country": "France",
"city": "Lyon",
"amount": 50,
},
{
"id": 5,
"country": "France",
"city": "Lyon",
"amount": 50,
}
]
我尝试过滤重复项
df[df.duplicated(['country','city','amount', 'duplicated'], keep = False)]
但它只返回相同的 df。
【问题讨论】:
-
您的实际数据是否像示例数据中那样有
duplicated列?
标签: python python-3.x pandas list dataframe