【发布时间】:2018-03-04 18:11:45
【问题描述】:
我有一个数据框:
DF <- data.frame(Value = c("AB", "BC", "CD", "DE", "EF", "FG", "GH", "HI", "IJ", "JK", "KL", "LM"),
ID = c(1, 0, 0, 1, 0, 1, 1, 0, 0, 1, 0, 1))
我的问题:我想创建一个新列,其中包含一个(二进制)随机数('0'或'1')用于病例 'ID' == 1 具有固定比例(或预定义的流行率)(例如,随机数 '0' x 2 和 '1' x 4) .
编辑我: 对于非特定情况的目的,解决方案可能是:
DF$RANDOM[sample(1:nrow(DF), nrow(DF), FALSE)] <- rep(RANDOM, c(nrow(DF)-4,4))
但是,我仍然需要特定于 cas 的分配,并且上述解决方案没有明确引用“0”或“1”。
(注意:变量“value”与问题无关;只是一个标识符。)
我在 stratified sampling 或 random row selection 上找到了相关帖子 - 但这些(和其他)帖子并未涵盖这个问题。
非常感谢您。
【问题讨论】: