【问题标题】:Detecting Outlier from data set by using Tukey method python使用Tukey方法python从数据集中检测异常值
【发布时间】:2019-11-10 07:25:16
【问题描述】:

我的数据框形状为 1000 个观测值,6 列

前四列是int,后两列是字符串数据类型。

我需要帮助找到可以帮助我使用 tukey 方法检测异常值并将异常值替换为 nan 值而不删除异常值的函数代码。

我尝试了许多代码来检测异常值,但由于我的数据框中的字符串数据类型,我面临错误消息。

【问题讨论】:

    标签: python statistics outliers tukey


    【解决方案1】:

    使用df.drop() 方法删除最后两个字符串列

    df.drop(['B', 'C'], axis=1)
    

    使用Tukey方法识别异常值后,使用df[i] = NaN替换异常值。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2019-12-10
      • 2014-04-16
      • 2021-07-22
      • 2021-10-22
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多