【发布时间】:2022-09-23 23:51:19
【问题描述】:
我有一个如下所示的数据集:
COMPANY DATABREACH CYBERBACKGROUND
A 1 2
B 0 2
C 0 1
D 0 2
E 1 1
F 1 2
G 0 2
H 0 2
I 0 2
J 0 2
不,我想创建以下内容: 40% 的 DATABREACH 列的值为 1,我希望 CYBERBACKGROUND 的值为 2。我认为必须有一些函数来执行此操作,但我找不到它。
-
如果我理解,那么每当
DATABREACH的值为 1 时,您希望随机覆盖(概率为 0.4)CYBERBACKGROUND的值为 2,对吗?你是否意识到,只有“E”公司在这里有机会改变,其他公司都保持不变? -
这只是数据集的一部分,我有 11,000 个观察值。但是,是的,每当 DATABREACH 的值为 1 时,我想用 2 的值随机覆盖(概率为 0.4)CYBERBACKGROUND。
标签: r