【发布时间】:2021-08-27 10:27:29
【问题描述】:
值计数为:df['ID'].value_counts().values -----> 数组([4,3,3,1], dtype=int64)
输入:
ID emp
a 1
a 1
b 1
a 1
b 1
c 1
c 1
a 1
b 1
c 1
d 1
当我弄乱了 ID 列时
df.loc[~df.duplicated(keep='first', subset=['ID']), 'emp']= df['ID'].value_counts().values
输出:
ID emp
a 4
c 3
d 3
c 1
b 1
a 1
c 1
a 1
b 1
b 1
a 1
预期结果:
ID emp
a 4
c 3
d 1
c 1
b 3
a 1
c 1
a 1
b 1
b 1
a 1
问题:计数在分配 emp 之前没有检查 ID。
【问题讨论】:
-
我尝试为给定的数据运行代码 sn-p,输出与您预期的相同,您有
ID列作为索引吗?你可以加入yesterday's chat here -
我的 ID 混乱:ID emp a 4 c 1 d 3 c 1 b 1 a 3 c 1 a 1 b 1 b 1 a 1
-
IDK 如果这已经被问过但是
pandas版本? -
>pandas) (1.15.0) 我更新了问题以便更好地理解
-
如果我更改了 ID 列顺序,则无法正确映射 ID。那么有没有办法将计数映射到相同的 emp 值?
标签: python pandas dataframe count duplicates