【发布时间】:2017-05-29 13:41:29
【问题描述】:
在 R 中,我有一个大型数据框列表,包含两列 value 和 count。我在上一步中使用的函数返回value 中的观察值,对应的列count 显示该特定值已被观察到的次数。以下代码生成 one 数据框作为示例 - 但是列表中的所有数据框确实具有不同的值。取值范围:
d <- as.data.frame(
cbind(
value = runif(n = 1856, min = 921, max = 4187),
count = runif(n = 1856, min = 0, max = 20000)
)
)
现在我想汇总数据以创建可视化的可视化。此聚合应应用于列表中的所有数据帧,每个数据帧都有不同的值范围。我正在寻找一个函数,将数据切割成新的值和计数,有点像直方图函数。因此,例如,对于值从 0 到 100 的所有数据,应将计数求和(依此类推,在定义的区间内,以干净的区间边界起点(如 0)为起点)。
我的第一次尝试是创建一个简单的值向量,其中每个值重复的次数由count 字段确定。然后,下一步将应用hist() 函数而不进行绘图以获得可以在hist() 的参数中定义的聚合值和计数。但是,这会产生 R 无法再处理的太大向量(每个 Gb)。我感谢任何解决方案或提示!
【问题讨论】:
标签: r aggregate classification histogram