【发布时间】:2020-11-21 09:44:25
【问题描述】:
我有一个年龄字段中有一些异常值的数据集,这里是我排序的数据的唯一值
unique = df_csv['AGE'].unique()
print (sorted(unique))
[21, 22, 23, 24, 25, 26, 27, 28, 29, 30, 31, 32, 33, 34, 35, 36, 37, 38, 39, 40, 41, 42, 43, 44, 45, 46, 47, 48, 49, 50, 51, 52, 53, 54, 55, 56, 57, 58, 59, 60, 61, 62, 63, 64, 65, 66, 67, 68, 69、70、71、72、73、74、75、79、126、140、149、152、228、235、267]
如何将大于 80 的任何值替换为我的 Age 列的平均值或中位数?
【问题讨论】: