【问题标题】:Data timestamped to minutes, keep data every 5, 30 minutes best way to implement it数据时间戳以分钟为单位,每 5、30 分钟保存一次数据是实现它的最佳方式
【发布时间】:2019-03-01 08:30:04
【问题描述】:

我有一些数据每分钟都有时间戳,如下所示:

  date time_greece gmt_offset_greece price_greece time_and_date 
  gmt_offset_greece_test time_and_date_correct time_and_date_difference ID
1 2009-12-01  08:30:04.548 +2 2275.32 2009-12-01 08:30:04.548 2 2009-12-01 06:30:04 0 1

我想以 5 分钟、30 分钟的间隔等执行不同的分析。目前,我已经根据行号和 30 之间的模运算创建了一个 ID(我会为 5 分钟的间隔等做类似的事情。 )

statadata$ID <- seq.int(nrow(statadata))
statadata$ID <- seq.int(nrow(statadata)) %% 30

我的问题是,有没有比我目前使用的更有效的方法来实现这一点,而我没有想到/不知道?

【问题讨论】:

    标签: r


    【解决方案1】:

    lubridate 包作为日期和日期时间的舍入函数,可以舍入到任意时间单位,例如5分钟,30分钟,还有地板和天花板。有了这个,您应该能够像lubridate::round(date_time_greece, '5 minutes') 一样简单地定义您的间隔。 与所有用于数据分析的分箱操作一样,请注意您的组。 IE。您的分组/分箱是否仅使用一个数据点创建了许多组。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2019-04-12
      • 2019-09-05
      • 1970-01-01
      相关资源
      最近更新 更多