【发布时间】:2018-05-09 15:43:37
【问题描述】:
如果这是一个简单的问题,我们深表歉意。我有整齐(长)格式的数据。我想看看Factor Name 中的值集对于Sample Name 中的每个样本有何不同。我相信使用 group_by 函数是可能的。
# Groups: Sample Name
`Sample Name` `Factor Name` mean
<fct> <fct> <dbl>
1 S1 ABCD -5.15
2 S1 EFGH 7.74
3 S1 IJKL -7.43
4 S2 ABCD 4.35
5 S2 EFGH -2.15
6 S2 IJKL 2.33
7 S3 ABCD 5.53
8 S3 EFGH 2.84
9 S3 IJKL 1.61
10 S3 MNOP NaN
我也尝试过聚合,虽然它给出了输出,但我更喜欢 group_by 或管道有效的方法。
Aggregate(`Factor Name` ~ `Sample Name`, df, FUN= function(x) setdiff(unique(df$`Factor Name`),x))
如果可能的话,我希望能够为每个示例名称添加缺少的Factor Name,如下所示:
# Groups: Sample Name
`Sample Name` `Factor Name` mean
<fct> <fct> <dbl>
1 S1 ABCD -5.15
2 S1 EFGH 7.74
3 S1 IJKL -7.43
4 S1 MNOP NaN
5 S2 ABCD 4.35
6 S2 EFGH -2.15
7 S2 IJKL 2.33
8 S2 MNOP NaN
9 S3 ABCD 5.53
10 S3 EFGH 2.84
11 S3 IJKL 1.61
12 S3 MNOP NaN
【问题讨论】: