【问题标题】:Looping over large List, finding best fitting homologe to gene遍历大列表,找到与基因最匹配的同源物
【发布时间】:2019-06-11 15:38:14
【问题描述】:

我有一个很大的基因列表,我想查找同源物。

我还有一个带有潜在同源物的大型数据框。 此 Dataframe 的第十列继承了一个数字,描述了拟合。数字越大越好。

我正在尝试遍历这个庞大的基因列表。

对于列表中的每个独特基因,我想选择最适合的同源基因。

输出应该是一个数据框,每个基因一行,描述最合适的同源物。

【问题讨论】:

标签: r bioinformatics


【解决方案1】:

Tidyverse 解决方案,假设您有一个列,每个基因都有一个 gene_id,并且拟合分数在一个名为 score 的列中:

library(tidyverse)

df %>% group_by(gene_id) %>% filter(score == max(score)) %>% ungroup()

【讨论】:

  • 这似乎是一个整洁的解决方案 =,D。但是每当我在安装后尝试将包加载到库中时,都会出现以下错误。库中的错误(tidyverse):没有名为“tidyverse”的包
  • @JonasEngelhardt 你实际上只需要 dplyr 包而不是整个 tidyverse。
猜你喜欢
  • 1970-01-01
  • 2021-04-07
  • 2021-07-15
  • 1970-01-01
  • 1970-01-01
  • 2023-02-17
  • 1970-01-01
  • 2019-08-03
  • 2017-01-21
相关资源
最近更新 更多