【发布时间】:2011-10-26 03:01:02
【问题描述】:
假设我们有一个数据框(第三列是日期列),其中包含从 2000 年 1 月到 2011 年 10 月期间对不规则事件的观察。目标是选择数据框中包含两个日期之间观察的那些行
start<-"2005/09/30"
end<-"2011/01/31"
原始数据框包含大约 21 000 行。我们可以使用
length(df_original$date_column)。
我们现在创建一个包含比开始日期新的日期的新数据框:
df_new<-df_original[df_original$date_column>start,]
如果我使用 length(df_new$date_column) 检查长度,它显示的长度约为 13 000。
现在我们创建另一个应用第二个标准(小于结束日期)的数据框:
df_new2<-df_new[df_new$date_column<end,]
如果我再次使用 length(df_new2$date_column) 检查长度,它会显示大约 19 000 个长度计数。
如何通过对新数据框df_new 应用第二个标准来增加行数? df_new 的行数应等于或低于 13 000。
数据框很大,我不能在这里发布。也许有人可以提供发生这种行为的原因。
【问题讨论】: