【发布时间】:2022-01-01 06:57:10
【问题描述】:
我正在使用 R 编程语言。假设我有以下数据:
a = rnorm(1000,10,1)
b = rnorm(200,3,1)
c = rnorm(200,13,1)
d = c(a,b,c)
index <- 1:1400
my_data = data.frame(index,d)
我可以通过调整“bin”长度(通过“breaks”选项)制作相同数据的以下直方图:
hist(my_data, breaks = 10, main = "Histogram #1, Breaks = 10")
hist(my_data, breaks = 100, main = "Histogram #2, Breaks = 100")
hist(my_data, breaks = 5, main = "Histogram #3, Breaks = 5")
我的问题:在每个直方图中都有不同数量的“条”(即箱)。例如,在第一个直方图中有 8 个条形图,在第三个直方图中有 4 个条形图。对于这些直方图中的每一个,有没有一种方法可以找出每个条形图中的哪些观察值(来自原始文件“d”)?
现在,我正在尝试手动执行此操作,例如(直方图#3)
histogram3_bar1 <- my_data[which(my_data$d < 5 & my_data$d > 0), ]
histogram3_bar2 <- my_data[which(my_data$d < 10 & my_data$d > 5), ]
histogram3_bar3 <- my_data[which(my_data$d < 15 & my_data$d > 10), ]
histogram3_bar4 <- my_data[which(my_data$d < 15 & my_data$d > 20), ]
head(histogram3_bar1)
index d
1001 1001 4.156393
1002 1002 3.358958
1003 1003 1.605904
1004 1004 3.603535
1006 1006 2.943456
1007 1007 1.586542
但是有没有更“有效”的方法来做到这一点?
谢谢!
【问题讨论】:
-
我相信你想要
cut(),也许和split()一起使用 -
@Moody_Mudskipper:谢谢你的回复!我会研究这个功能 - 谢谢!
标签: r plot data-visualization histogram data-manipulation