【发布时间】:2015-05-04 16:37:30
【问题描述】:
尝试在 R 中使用 fitdistr() 拟合卡方分布。关于此的文档在这里(对我来说不是很有用):https://stat.ethz.ch/R-manual/R-devel/library/MASS/html/fitdistr.html
问题 1:chi_df 下面的输出如下:3.85546875 (0.07695236)。第二个数字是多少?方差还是标准差?
问题 2:fitdistr 生成由 Chi-SQ 分布定义的“k”。如何拟合数据以获得缩放常数“A”?我愚蠢地使用下面的第 14-17 行。显然不好。
问题 3:Chi-SQ 分布是否仅针对某个 x 范围定义? (方差定义为 2K,而均值 = k。这必须需要一些受约束的 x 范围......统计问题不是编程......)
nnn = 1000;
## Generating a chi-sq distribution
chii <- rchisq(nnn,4, ncp = 0);
## Plotting Histogram
chi_hist <- hist(chii);
## Fitting. Gives probability density which must be scaled.
chi_df <- fitdistr(chii,"chi-squared",start=list(df=3));
chi_k <- chi_df[[1]][1];
## Plotting a fitted line:
## Spanning x-length of chi-sq data
x_chi_fit <- 1:nnn*((max(chi_hist[[1]][])-min(chi_hist[[1]][]))/nnn);
## Y data using eqn for probability function
y_chi_fit <- (1/(2^(chi_k/2)*gamma(chi_k/2)) * x_chi_fit^(chi_k/2-1) * exp(-x_chi_fit/2));
## Normalizing to the peak of the histogram
y_chi_fit <- y_chi_fit*(max(chi_hist[[2]][]/max(y_chi_fit)));
## Plotting the line
lines(x_chi_fit,y_chi_fit,lwd=2,col="green");
感谢您的帮助!
【问题讨论】:
-
1) 根据帮助文件的
str(chi_df)和Value:部分,我收集到第二个值是估计值的标准差。 -
“这方面的文档很糟糕”——你能澄清一下吗?我发现文档非常好。例如,它或多或少地回答了您的第一个问题。
-
@rawr 不需要那些分号。事实上,R中不要使用分号
-
@rawr 的第一条评论是讽刺的,我想。第二个是模糊地指出这一点(我认为 - 这对我来说更加模糊)。 (注意:讽刺/讽刺不一定在在线环境中翻译得很好,尤其是在国际环境中......)
-
准确地说,博克教授
标签: r distribution data-fitting chi-squared