【发布时间】:2012-03-09 14:37:07
【问题描述】:
我有一个从 1996 年到 2010 年的每小时数据集,格式如下:
date value
1- - -1996-01-01 00:00:00- - - NA
2- - -1996-01-01 01:00:00- - - 38
3 - - -1996-01-01 02:00:00- - - 44
4- - -1996-01-01 03:00:00- - - 48
5- - -1996-01-01 04:00:00- - - 42
6- - -1996-01-01 05:00:00- - - 44
7- - - 1996-01-01 06:00:00- - - 38
8- - - 1996-01-01 07:00:00- - - 42
9- - -1996-01-01 08:00:00- - - 44
10- - -1996-01-01 09:00:00- - - 44
我有很多缺失的小时数数据,我试图通过取前一小时和下一小时的平均值来计算缺失的小时值,如果缺失了很多小时,我试图通过每天取该小时的平均值来计算那一年,只是想知道这是否可能?
我尝试了以下方法,但这给了我整个数据集的平均值:
a = c(NA, 1, 2, 3, 10)
a[which(is.na(a)==TRUE)] = mean(a,na.rm = T)
我非常感谢有关如何进行此计算的任何建议。
【问题讨论】:
标签: r