【问题标题】:Impute missing variable id's into a time series panel将缺失的变量 id 输入到时间序列面板中
【发布时间】:2022-01-07 13:54:05
【问题描述】:

为了进行时间序列分析,我想使用如下所示的数据框:

data <- data.frame (Store_ID = as.character(c(seq( 1, length.out = 10),
                                              seq( 1, length.out = 9),
                                              c(1,2,3,4,6,7,8,9))),
                    amount_sold = c(seq( 1, 9, length.out = 27)),
                    date = c(rep(as.Date("2015-01-01"),10),
                             rep(as.Date("2015-01-02"),9),
                             rep(as.Date("2015-01-03"),8)
                             )
                            )

如您所见,第一个日期(2015-01-01)有 10 个 Store_ID,但下一个日期只有 9 个,最后一个日期只有 8 个。

为了我的分析,我需要添加接下来两天丢失的 Store_ID。因此,我希望为缺少的 Store_ID 提供 30 行和一个“0”作为 amount_sold。

【问题讨论】:

    标签: r time-series data-manipulation missing-data data-wrangling


    【解决方案1】:

    试试

    library(tidyr)
    
    data <- data.frame (Store_ID = as.character(c(seq( 1, length.out = 10),
                                              seq( 1, length.out = 9),
                                              c(1,2,3,4,6,7,8,9))),
                    amount_sold = c(seq( 1, 9, length.out = 27)),
                    date = c(rep(as.Date("2015-01-01"),10),
                             rep(as.Date("2015-01-02"),9),
                             rep(as.Date("2015-01-03"),8)
                    )
    ) %>%
      complete(Store_ID, date, fill = list(amount_sold = 0)) 
    

    【讨论】:

    • 感谢您提供简单的解决方案!
    猜你喜欢
    • 2015-08-08
    • 1970-01-01
    • 2023-02-24
    • 2020-04-12
    • 2019-07-20
    • 2018-08-24
    • 1970-01-01
    • 1970-01-01
    • 2012-11-09
    相关资源
    最近更新 更多