【发布时间】:2019-07-18 16:40:44
【问题描述】:
我希望能够识别具有唯一值的香蕉之间的水果,并且最后一根香蕉也标有该唯一值。其他所有内容,例如在第一个香蕉之前或最后一个香蕉之后,或者如果连续有两个、三个香蕉 - 不符合我的兴趣 - 它们可以有 0 作为值或被删除。如果我听起来太混乱,请参考所需的输出。我希望有人有一个想法。我一直在谷歌搜索和 stackoverflow 没有任何成功。我希望以前没有人问过这件事并不容易。
fruits <- c("apples", "pears","bananas", "cherries")
customer <- rep(c(1:10), each = 3)
set.seed(1236)
df_fruits <- data.frame(customer = sample(customer, 30, replace = T),
fruits = sample(fruits,30, replace = T, prob=c(0.29,0.60,0.5,0.1)))
df_fruits <- distinct(df_fruits,.keep_all = T)
df_fruits
期望的输出
customer fruits section
1 8 pears 0
2 7 cherries 0
3 5 bananas 0
4 5 pears 1
5 10 bananas 1
6 9 pears 2
7 10 pears 2
8 1 apples 2
9 1 pears 2
10 4 pears 2
11 6 pears 2
12 6 cherries 2
13 4 apples 2
14 8 apples 2
15 2 pears 2
16 1 bananas 2
17 8 bananas 0
18 9 bananas 0
19 3 bananas 0
20 3 pears 3
21 2 bananas 3
提前谢谢你!
【问题讨论】:
标签: r dplyr tidyverse data-manipulation