【发布时间】:2020-03-18 17:36:22
【问题描述】:
我有一个问题,我会尽力解释。
假设我有以下数据集,我们称之为 extra_events:
Year WEvents
1 1
2 3
3 1
4 2
5 3
6 0
7 3
8 0
9 2
10 3
我有一个不同的数据集,我们称之为weather_loss:
Event Loss
11 2
21 3
24 5
27 8
30 10
34 7
37 1
41 14
45 15
我的目标是从 weevents 列中随机抽取 weather_loss(事件列)到 extra_events 中每一行的次数(当然要替换)
例如,输出将如下所示:
Year Wevents Sim1 Sim2 Sim3
1 1 21 NA NA
2 3 24 30 37
3 1 11 NA NA
4 2 45 41 NA
5 3 30 34 37
6 0 NA NA NA
7 3 24 27 34
8 0 NA NA NA
9 2 37 45 NA
10 3 11 21 30
通过这种方式,我可以看到每年我必须采样多少事件以及采样了哪些事件。
谁能帮我解决这个问题。我不一定需要有 NA。
【问题讨论】:
-
我很困惑。您希望 extra_events 中的每一行都有来自 weather_loss 的 3 个不同的随机事件值吗?如果是这样,为什么是“NA”?
-
另外,你用的是什么数据库?
-
啊,对不起,重读后,我现在明白了这个问题。 WEvents 中的值是否有上限,还是任意的?
-
这是任意的,我是从泊松分布中采样的。对于 WEvents,它可以永远持续下去。
-
在这种情况下,返回的列数是非常动态的,那么您是否可以将每个 Sim 值作为单独的行,或者甚至是逗号分隔的字符串?
标签: r