【发布时间】:2021-09-10 05:08:38
【问题描述】:
我是 R 新手,我一直在使用 dplyr 包进行总结。我想不出以下问题的解决方案。
我的小标题:8 x 3 如下:
df <- tibble(id = c(1, 1, 1, 1, 1, 2, 2, 2 ),
block = c(2, 2, 2, 3, 3, 2, 2, 3),
answer = "TRUE")
| id | block | answer |
|---|---|---|
| 1 | 2 | TRUE |
| 1 | 2 | TRUE |
| 1 | 2 | TRUE |
| 1 | 3 | TRUE |
| 1 | 3 | TRUE |
| 2 | 2 | TRUE |
| 2 | 2 | TRUE |
| 2 | 3 | TRUE |
ID -> 参与者 ID
block -> 最高正确的block
我只想保留每个参与者的最高块分数,但最高块分数定义为在每个块条件中至少有两个正确 (TRUE) 的最高分数。
在上面的示例中,参与者 1 的最高分块分数为 3,因为在块 3 处至少有两个正确的回答。参与者 2 的最高分数是 2。请参见下面的示例。
最终的输出应该是这样的:
| id | block | answer |
|---|---|---|
| 1 | 3 | TRUE |
| 2 | 2 | TRUE |
有人知道我应该如何开始吗?或者有什么包可以解决这个问题?
我设法使用slice_tail 参数为每个参与者维护了最后一行,但不知道如何从那里继续
【问题讨论】: