【发布时间】:2020-06-12 12:15:55
【问题描述】:
您好,我有一个由不同相机组成的数据集,每个日期和小时都有观察结果,它看起来大致如下:
d <- read.table(text=
'Camera datehour order observations
1 2019051212 Araneae 2
1 2019051213 Araneae 4
1 2019051214 Lepidoptera 3
1 2019051215 Lepidoptera 2
2 2019051213 Lepidoptera 5
4 2019051214 Araneae 3
4 2019060423 Araneae 2
5 2019070503 Araneae 1
5 2019070503 Araneae 6 ', header=TRUE)
如您所见,摄像机 1 已拍摄 4 小时,摄像机 2 已拍摄 1 小时,摄像机 4 已拍摄 2 小时,摄像机 5 已拍摄 1 小时。我想添加一个额外的列,其中包含每个订单每小时每台摄像机的平均值,应该如下所示:
Camera datehour order observations mean
1 2019051212 Araneae 2 0.5
1 2019051213 Araneae 4 1
1 2019051214 Lepidoptera 3 0.75
1 2019051215 Lepidoptera 2 0.5
2 2019051213 Lepidoptera 5 5
4 2019051214 Araneae 3 1.5
4 2019051223 Araneae 2 1
5 2019070503 Araneae 1 1
5 2019070503 Lepidoptera 6 6
编辑:“平均值是通过将每个相机的唯一“日期小时”计数除以观察结果来计算的。
示例:摄像机 1 有 4 个唯一的“日期时间”,因此 Araneae(2) 第一次观察的平均值为 0.5"
最后,我想绘制在 x 轴上具有顺序且在 y 轴上具有平均值的数据(忽略相机编号)。这会是正确的方法吗?我可以用这个计算标准误差吗?
我尝试了谷歌,但老实说,一切似乎都让人不知所措,我找不到我想要的答案。
提前致谢!
【问题讨论】:
-
看起来只有摄像头 5 考虑了
order? -
您如何计算
mean列?你能举个例子吗? -
嗨@DanielO,摄像机 5 录制了 1 小时,但有 2 个不同的订单。所以平均值仍然是 1 和 6。谢谢
-
嗨@Henrik,日期和时间。谢谢
-
@Henrik,我现在明白这个问题了。如果您查看
Camera 5,如果对两个order进行了观察,则同一小时可能会出现在多行上。
标签: r mean standard-error