【问题标题】:How can i read each row till the first occurence of NaN.?在第一次出现 NaN 之前,我如何读取每一行?
【发布时间】:2020-09-02 11:44:06
【问题描述】:

我想从 excel 文件中读取每一行并独立使用它来处理

这里是数据在 excel 文件中的样子

12 32 45 67 89 54 23 56 78 98 34 76 34 89 34 3
76 34 54 12 43 78 56
76 56 45 23 43 45 67 76 67 8 87 9 9 0 89 90 6 89
23 90 90 32 23 34 56 9 56 87 23 56 34 3 5 8 7 6 98
32 23 34 6 65 78 67 87 89 87 12 23 34 32 43 67 45
343 76 56 7 8 9 4

但是当我通过 pandas 阅读它时,剩余的列将被 NaN 填充。

从 pandas 读取数据后的样子

0 12 32 45 67 89 54 23.0 56.0 78.0 98.0

1 34 76 34 89 34 3 NaN NaN NaN NaN

2 76 34 54 12 43 78 56.0 NaN NaN NaN

3 76 56 45 23 43 45 67.0 76.0 67.0 8.0

4 87 9 9 0 89 90 6.0 89.0 NaN NaN

5 23 90 90 32 23 34 56.0 9.0 56.0 87.0

6 23 56 34 3 5 8 7.0 6.0 98.0 NaN

7 32 23 34 6 65 78 67.0 87.0 89.0 87.0

8 12 23 34 32 43 67 45.0 NaN NaN NaN

9 343 76 56 7 8 9 4.0 5.0 8.0 68.0

在这里可以看到每一行的剩余列都填充了我不想要的 NaN。 我也不想用其他值替换它或删除包含 NaN 的整行。

如何读取每一行的列,直到第一次出现 NaN。 ?

例如,pandas 中的第二行是 34 76 34 89 34 3 NaN NaN NaN NaN

所以我想要的输出是它只读取 34 76 34 89 34 3

我的偏好是 pandas,但如果不可能,那么他们是否可以像使用其他一些库一样以其他方式进行操作 任何资源或参考资料会有帮助吗? 谢谢

【问题讨论】:

    标签: python python-3.x pandas dataframe data-science


    【解决方案1】:

    在调用 pd.read_excel 函数时,尝试设置 keep_default_na = False。这将在读取时避免默认的 NaN 值。

    【讨论】:

    • 谢谢...但是当我通过 ar 模型传递它时,它给了我一个错误“无法将字符串转换为浮点数”
    猜你喜欢
    • 1970-01-01
    • 2021-09-30
    • 2011-04-10
    • 1970-01-01
    • 2019-02-08
    • 2014-07-15
    • 2020-04-10
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多