【发布时间】:2019-11-10 07:25:16
【问题描述】:
我的数据框形状为 1000 个观测值,6 列
前四列是int,后两列是字符串数据类型。
我需要帮助找到可以帮助我使用 tukey 方法检测异常值并将异常值替换为 nan 值而不删除异常值的函数代码。
我尝试了许多代码来检测异常值,但由于我的数据框中的字符串数据类型,我面临错误消息。
【问题讨论】:
标签: python statistics outliers tukey
我的数据框形状为 1000 个观测值,6 列
前四列是int,后两列是字符串数据类型。
我需要帮助找到可以帮助我使用 tukey 方法检测异常值并将异常值替换为 nan 值而不删除异常值的函数代码。
我尝试了许多代码来检测异常值,但由于我的数据框中的字符串数据类型,我面临错误消息。
【问题讨论】:
标签: python statistics outliers tukey
使用df.drop() 方法删除最后两个字符串列
df.drop(['B', 'C'], axis=1)
使用Tukey方法识别异常值后,使用df[i] = NaN替换异常值。
【讨论】: