【发布时间】:2014-08-26 00:50:35
【问题描述】:
我正在尝试计算用户的“死亡”,这意味着我想确定从用户注册某个程序到他们不再在该程序中处于活动状态之间的持续时间。我有两个使用read.csv("filename",header=TRUE) 读入的文件:
> df
name start.date
1 Allison 2013-03-16
2 Andrew 2013-03-16
3 Carl 2013-03-16
4 Dora 2013-03-17
5 Hilary 2013-03-17
6 Louis 2013-03-19
7 Mary 2013-03-20
8 Mickey 2013-03-20
还有文件 2:
> df2
names X04.16.2013 X04.17.2013 X04.18.2014 X04.19.2013
2001 Allison 5 5 0 0
2002 Andrew 0 0 0 0
2003 Carl 8 8 11 10
2004 Dora 6 4 9 3
2005 Hilary 2 0 0 0
2006 Louis 18 10 8 3
2007 Mary 4 7 7 0
2008 Mickey 9 5 0 0
我想做的是将 df2 的标题名称转换为日期,这样我就可以创建一个新的数据框,其中包含用户名、开始日期和“死亡天数”,这将是当用户df2 中的条目为 0:
name start.date days.to.death
1 Allison 2013-03-16 33
2 Andrew 2013-03-16 0
3 Carl 2013-03-16 NA
4 Dora 2013-03-17 NA
5 Hilary 2013-03-17 31
6 Louis 2013-03-19 NA
7 Mary 2013-03-20 30
8 Mickey 2013-03-20 28
请注意,安德鲁从未“活着”,而卡尔、朵拉和路易斯还没有“死去”。我对 R 还是比较陌生,因此非常感谢任何输入!
【问题讨论】:
-
这是 df2 的列标题中的错字吗?都应该是 2013 年吗?
-
我很抱歉。是的,df2 中的所有日期都应该是 2013 年
标签: r time-series