【问题标题】:Python/Pandas only showing the first 10 and last 10 columns in a data framePython/Pandas 仅显示数据框中的前 10 列和后 10 列
【发布时间】:2020-02-25 04:27:14
【问题描述】:

我对数据科学和机器学习还比较陌生,目前我正在处理我的第一个项目,其中包含一个非常大的数据集,超过 100 万行和 88 列`。

我目前正在清理数据并尝试使用data.isnull().sum()data[data.isnull().values.any(axis=1)].head() 等功能,但我的 Jupiter 笔记本文件只会显示前十列和后十列。

只是寻找查看数据的最佳方式或被定向到任何可能有帮助的资源。

【问题讨论】:

  • 这能回答你的问题吗? Pretty-print an entire Pandas Series / DataFrame
  • 您在代码中使用了.head()。这只会给你前 10 列(默认情况下)。还要检查你是否使用.tail(),这只会给出最后 10 个。
  • 欢迎堆栈溢出!值得注意的是,这是一个显示功能,而不是错误。您真的希望每次查看数据时都显示一百万行吗?这需要大量滚动,并且有更好的方法来验证您正在做的事情是否正在生效,而无需目视检查 DF

标签: python python-3.x pandas dataframe data-cleaning


【解决方案1】:

您可以通过放置来更改显示的列数:

#without restriction
pd.set_option('display.max_columns', None)

【讨论】:

    【解决方案2】:

    您在代码中使用.head()

    data[data.isnull().values.any(axis=1)].head().

    默认情况下,这将为您提供前 10 列。您可以指定要查看的列数作为.head() 的参数。

    如果您从上面的行中删除 .head(),您将看到完整的数据框。

    同样,检查您是否在某处使用.tail()。这将为您提供最后 10 列。

    【讨论】:

      【解决方案3】:

      尝试使用这个

         pd.set_option('display.max_columns', 30)
      

      您可以根据需要更改号码。使用 None 作为完整列表。

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 2015-12-09
        • 2021-03-28
        • 1970-01-01
        • 2021-11-06
        • 2021-08-14
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        相关资源
        最近更新 更多