【问题标题】:How can I normalize a range of data in pandas where one column is categorical?如何规范化熊猫中一列是分类的一系列数据?
【发布时间】:2019-01-29 15:13:21
【问题描述】:

我一直在尝试预处理一组数据,但由于其中一个列具有分类值,我无法获得正确的值。

Data Type Sample

执行标准化后,我得到了教育学位类别中的值。 Normalization Result

有没有更好的选择来处理这个问题或任何替代方法来使结果更好?

【问题讨论】:

  • Welcome to SO!... 如果您有一些文本数据,请不要将其作为图像包含,而是作为文本包含。如果您在格式化方面遇到困难,除了您的实际问题之外,有人也可以帮助您解决...顺便说一句:您想要的输出是什么?
  • 感谢您的建议,我会记住它以备将来使用。我期望有一系列缩放值,这些值将以不会对缩放值进行分类的方式给出值。

标签: python pandas normalization scaling preprocessor


【解决方案1】:

只需从数据框中创建一个您必须标准化的列列表。

cols = ['A','B']
for col in cols:
  df[col] = (df[col]-df[col].min())/(df[col].max()-df[col].min())

【讨论】:

    猜你喜欢
    • 2015-04-19
    • 2014-12-12
    • 2020-10-21
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-10-11
    • 2021-04-11
    • 2018-11-10
    相关资源
    最近更新 更多