【发布时间】:2014-06-16 06:52:40
【问题描述】:
我有一个看起来像这样的 numpy 数组:
day1, day2, ..., dayM
year month
1 .
2 .
. .
. .
. .
N (yearN,dayM)
在我看来,这种格式有点奇怪。对于此类工作,我宁愿将数据放在一个列中,然后再加载到 pandas 中(或者,如果有更方便的可用内容,我可以先加载到 pandas 中)。
我可以使用一些简单的方法专门针对“日”行和列执行此操作吗?我不太关心保留“年”和“月”,所以让我们假装它们不存在。
编辑:我忘了提到,虽然“日”矩阵中的每一行长度为 31,但我只需要保留对应于该月的数量(包括闰年)。看起来可能是时候循环了......
【问题讨论】:
-
你试过numpy的reshape函数吗?
-
应该非常直接地使用 pandas
stack和一些字符串解析。 -
@U2EF1 我以前从未使用过堆栈,但实际上它看起来非常有用。不过,可能需要花点时间来处理索引后记。
标签: python arrays numpy pandas