【发布时间】:2021-09-16 11:41:49
【问题描述】:
我有一个这样的数据框(df):
| Category | Var1 | Var2 |
| -------- | ---- | ---- |
| Num1 | row | row |
| Num1 | row | row |
| Num1_ | row | row |
| Num1_ | row | row |
| Num2 | row | row |
| Num2 | row | row |
| Num2_ | row | row |
| Num2_ | row | row |
| Num0_ | row | row |
| Num0 | row | row |
如果我使用:
g = df.groupby('Category')
它创建一个 groupby 对象 g,其组由相等的 Category 确定。在这个例子中 Num1、Num1_、Num2、Num2_ Num0_ 和 Num0。
我只想按字符串的一部分进行分组。 例如将 Num1 和 Num1_ 放在一起,从而忽略 _
另外,有没有办法将 Num1 和 Num1_ 、 Num2 和 Num2_ 放在一起,但保持分开的 Num0_ 和 Num0
【问题讨论】:
标签: python pandas group-by pandas-groupby