【发布时间】:2017-02-24 16:08:59
【问题描述】:
目前,我正在尝试引导一个包含 114 个 obs 和 16 个变量的数据集。
我使用的示例函数如下:
x[sample(nrow(x),size=114,replace=TRUE),] where x is my dataset.
但是,我想使用分配给特定列的概率进行采样,因为示例函数包含这种可能性。例如,我想以 1-5 0.1 和 5-200 0.9 之间的数字概率对第 5 列进行采样。
我该怎么做?
【问题讨论】:
-
在寻求帮助时,您应该在reproducible example 中包含示例输入和所需的输出。您究竟是如何“存储”这些需求的?
-
@MrFlick 感谢您的帮助,我目前正在按天对这些列进行排序,因为它是不列颠之战数据。因此,我的专栏是当前的个别日子和坠毁的飞机,以及他们袭击的位置。因此,我有效地寻求重新采样数据以创建反事实历史。例如,如果德国只攻击伦敦,它将如何影响英国的损失。