【发布时间】:2021-08-16 06:46:26
【问题描述】:
我的数据框 df 具有以下特征
| store_id | city_id | sales_A | sales_B | sales_C |
|---|---|---|---|---|
| STORE01 | CITY99 | 100 Item | None | None |
| STORE01 | CITY99 | None | 200 Order | None |
| STORE01 | CITY99 | None | None | 300 Client |
| STORE01 | CITY99 | 150 Order | None | 300 Client |
| ... |
所有行都将具有相同的特征,其中相同的 store id 和 city ID 有 1 行或更多:
- 第 1 行:销售 A 有价值,其他无
- 第 2 行:销售 B 有价值,其他无
- 第 3 行:销售 C 有价值,其他无
- 第 4 行:销售 A 具有价值(但与第 1 行不同),其他无
注意值不是数字,是字符串,必须保持为字符串
行的顺序可能不同,但基本上每行都有 1 行或更多行,具体取决于销售额。
在 pandas 中,我如何将它们合并为一行,所以结果数据集将是这样的:
| store_id | city_id | sales_A | sales_B | sales_C |
|---|---|---|---|---|
| STORE01 | CITY99 | 100 Item, 150 Order | 200 Order | 300 Client |
谢谢
【问题讨论】:
标签: python python-3.x pandas