【问题标题】:How to import nominal features in numpy Python如何在 numpy Python 中导入名义特征
【发布时间】:2016-07-04 00:49:05
【问题描述】:
Botnet_Training_data = np.genfromtxt("training_data.txt", delimiter = ",")

这是我用来从文本文件导入数据的代码,但是,当我打印数据时,我看到的是:

print (Botnet_Training_data[0])

    [  0.00000000e+00   nan   nan   nan
   4.91000000e+02   0.00000000e+00   0.00000000e+00   0.00000000e+00]

我知道 nan 不是数字,但我想知道如何导入名义特征,如果可能的话

还有一个附带问题,sklearn 是否支持名义特征?

【问题讨论】:

    标签: python numpy machine-learning scikit-learn


    【解决方案1】:

    我不确定您所说的“名义”是什么意思。但默认情况下,genfromtxt 将值导入为浮点数。如果它不能将字符串转换为浮点数,它会将nan 放在那个槽中。

    试试dtype=None,然后告诉我们.shape.dtype的结果。

    类似的答案建议dtype=Nonehttps://stackoverflow.com/a/27067667/901925 在这里https://stackoverflow.com/a/36092934/901925

    我询问 shape 和 dtype 是因为它可能会产生一维结构化数组 - 这会导致其他常见的genfromtxt 问题。

    【讨论】:

    • 这似乎更像是一个评论而不是一个答案。
    • 真的很重要吗?这是一个很长的评论。如果 OP 添加了详细信息,我打算扩展我的答案。我不喜欢 cmets 中的扩展对话框。答案可以更好地格式化。
    • 这在网站的上下文中很重要。 使用 cmets 询问更多信息或提出改进建议。 作为答案,您已经完成了这两项工作。
    • 这是一个答案。我猜nominal 功能是字符串,他想导入它,而不是作为浮点数。使用genfromtxt(..., dtype=None) 可以做到这一点。我已经回答了很多genfromtxt 问题(大约 90 个)。
    • 有趣的是,我在stackoverflow.com/a/36092934/901925 中发表的评论回答了这个问题,没有人关注格式。在其他情况下,我已将评论复制到答案中。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-01-26
    • 2016-01-27
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多