【发布时间】:2016-12-26 15:18:46
【问题描述】:
我仍在处理我的纽约地铁数据。我以这样一种方式清理和整理数据,现在我在周末和工作日将每个站点每小时的“平均入口”和“平均出口”(范围从 0 到 23)分开(类别变量具有两个可能的值:周末/工作日)。
我试图做的是创建一个图,每个站都是一行,每行有两列(第一列是工作日,第二列是周末)。我想每小时绘制“平均入口”和“平均出口”,以获取有关车站的一些信息。这里有两件有趣的事情;首先,纯粹的数字表明车站有多忙;其次,给定小时内的出入口之间的比率,以表明车站是生活区(早上的入口负载,晚上的出口负载)还是更多的工作区域(早上的出口负载,入口负载在下午 4 点、6 点和 8 点左右偷看)。唯一的问题,大约有 550 个站点。
我尝试使用 seaborn facetgrid 绘制它,它无法处理多个站点(10 个左右)而不会遇到内存问题。
所以我想知道是否有人有一个好主意来完成我想做的事情。
请找到随附的笔记本(倒数第二个单元格显示了我对数据进行可视化的尝试,即 4 个站点的绘图)。这显然不适用于 500 多个站点,所以可能是连续 5 个站点?
最后一个单元格包含评论中要求的 Station R001 的数据..
https://github.com/FBosler/Udacity/blob/master/Example.ipynb
非常感谢任何输入! 费边
【问题讨论】:
-
您能否提供一个关于您拥有一个站点的数据的快速示例?
-
github.com/FBosler/Udacity/blob/master/Example.ipynb 最后一个单元格用于 R001 站
标签: python pandas matplotlib visualization subplot