【发布时间】:2020-09-02 11:44:06
【问题描述】:
我想从 excel 文件中读取每一行并独立使用它来处理
这里是数据在 excel 文件中的样子
12 32 45 67 89 54 23 56 78 98
34 76 34 89 34 3
76 34 54 12 43 78 56
76 56 45 23 43 45 67 76 67 8
87 9 9 0 89 90 6 89
23 90 90 32 23 34 56 9 56 87
23 56 34 3 5 8 7 6 98
32 23 34 6 65 78 67 87 89 87
12 23 34 32 43 67 45
343 76 56 7 8 9 4
但是当我通过 pandas 阅读它时,剩余的列将被 NaN 填充。
从 pandas 读取数据后的样子
0 12 32 45 67 89 54 23.0 56.0 78.0 98.0
1 34 76 34 89 34 3 NaN NaN NaN NaN
2 76 34 54 12 43 78 56.0 NaN NaN NaN
3 76 56 45 23 43 45 67.0 76.0 67.0 8.0
4 87 9 9 0 89 90 6.0 89.0 NaN NaN
5 23 90 90 32 23 34 56.0 9.0 56.0 87.0
6 23 56 34 3 5 8 7.0 6.0 98.0 NaN
7 32 23 34 6 65 78 67.0 87.0 89.0 87.0
8 12 23 34 32 43 67 45.0 NaN NaN NaN
9 343 76 56 7 8 9 4.0 5.0 8.0 68.0
在这里可以看到每一行的剩余列都填充了我不想要的 NaN。 我也不想用其他值替换它或删除包含 NaN 的整行。
如何读取每一行的列,直到第一次出现 NaN。 ?
例如,pandas 中的第二行是 34 76 34 89 34 3 NaN NaN NaN NaN
所以我想要的输出是它只读取 34 76 34 89 34 3
我的偏好是 pandas,但如果不可能,那么他们是否可以像使用其他一些库一样以其他方式进行操作 任何资源或参考资料会有帮助吗? 谢谢
【问题讨论】:
标签: python python-3.x pandas dataframe data-science