【发布时间】:2020-09-16 14:32:12
【问题描述】:
df <- data.frame(samples = c('45fe.K2','45fe.K2','45fe.K2','45hi.K1','45hi.K1'),source = c('f','f','o','o','f'))
df
samples sou
1 45fe.K2 f
2 45fe.K2 f
3 45fe.K2 o
4 45hi.K1 o
5 45hi.K1 f
我想计算samples中有多少来自souf或o。
结果应该是这样的
samples sou count
1 45fe.K2 f 2
3 45fe.K2 o 1
4 45hi.K1 o 1
5 45hi.K1 f 1
我试过了
df <- df %>%
group_by(sou) %>%
mutate(count = n_distinct(samples)) %>%
ungroup()
df <- within(df, { count <- ave(sou, samples, FUN=function(x) length(unique(x)))})
df$count <- ave(as.integer(df$samples), df$sou, FUN = function(x) length(unique(x)))
df$count <- with(df, ave(samples,sou, FUN = function(x) length(unique(x))))
所有这些仅计算唯一的 samples(即 2)或唯一数量的 sou(即 2)。但我想知道独特样本中有多少独特的苏。
【问题讨论】: