【发布时间】:2020-03-29 18:38:48
【问题描述】:
我有一个这样的熊猫数据框:
timestamp status
2019-01-01 09:00:00 FAILED
2019-01-01 09:00:00 FAILED
2019-01-01 09:00:00 UNKNOWN
2019-01-01 09:00:00 PASSED
2019-01-01 09:00:00 PASSED
2019-01-01 09:01:00 PASSED
2019-01-01 09:01:00 FAILED
如何对每分钟的数据进行分组,统计每分钟每个状态的数量,得到这个数据框:
timestamp PASSED FAILED UNKNOWN
2019-01-01 09:00:00 2 2 1
2019-01-01 09:01:00 1 1 0
【问题讨论】:
-
pd.crosstab(df['timestamp'],df['status']) -
你有没有想要按分钟分组的第二个值?
-
尝试了您的建议,似乎可行,非常感谢!在原始数据中,时间戳在一分钟内会有多个条目,因此在秒的范围内会有所不同。例如时间戳状态 2019-01-01 09:00:01 失败 2019-01-01 09:00:02 失败 2019-01-01 09:00:10 未知 2019-01-01 09:00:13 通过 2019-01- 01 09:00:24 通过 2019-01-01 09:01:02 通过 2019-01-01 09:01:30 失败
-
如果答案是交叉表,则问题是枢轴
标签: python pandas pandas-groupby