【发布时间】:2015-05-15 03:16:28
【问题描述】:
第一个问题。我是 R 的新手。我有以下数据框。
Source: local data frame [865,264 x 10]
page_views date dayofweek daytype caseID dateDecision dateArgument dateRearg
1 169 2008-01-30 Wednesday 0 2007-001 2007-10-10 2007-10-01
2 211 2008-01-16 Wednesday 0 2007-001 2007-10-10 2007-10-01
3 203 2008-01-17 Thursday 0 2007-001 2007-10-10 2007-10-01
4 177 2008-01-14 Monday 0 2007-001 2007-10-10 2007-10-01
5 224 2008-01-15 Tuesday 0 2007-001 2007-10-10 2007-10-01
6 152 2008-01-12 Saturday 1 2007-001 2007-10-10 2007-10-01
7 149 2008-01-13 Sunday 1 2007-001 2007-10-10 2007-10-01
8 220 2008-01-10 Thursday 0 2007-001 2007-10-10 2007-10-01
9 169 2008-01-11 Friday 0 2007-001 2007-10-10 2007-10-01
10 189 2008-01-18 Friday 0 2007-001 2007-10-10 2007-10-01
.. ... ... ... ... ... ... ... ...
Variables not shown: caseName (chr), term (int)
我想找到 page_views 大于零的每个 caseID 的第一个、最早的时间日期。我想用这个日期创建一个新列。每个 caseID 的结果应该有一行。
我希望我可以使用 dplyr 做到这一点,但我对其他解决方案持开放态度。使用 dplyr 似乎 group_by(caseID) 和某种过滤器是开始的地方,但我没有运气。
我搜索了 stackoverflow 和其他地方,但没有找到任何接近的东西。
【问题讨论】: