【发布时间】:2020-10-21 23:30:34
【问题描述】:
我的RDD实际上包含一些生物学数据,即蛋白质名称,以及它们之间的相似度。我想创建图,其中顶点是蛋白质,边表示相似值。这实际上是我的 RDD:
+-------------+------------+------------+
| Protein1 | Protein2 | Similarity |
+-------------+------------+------------+
| P28469 | Q70UP5 | 0.11111111 |
| O45687 | P00325 | 1.0 |
| A7ME43 | Q5HG16 | 0.6 |
| A4VJT7 | Q9LD43 | 1.0 |
| P31937 | Q64415 | 0.07692308 |
| A1VAA0 | Q9L298 | 1.0 |
| B8DG74 | Q6MT35 | 1.0 |
+-------------+------------+------------+
谢谢!
【问题讨论】:
-
添加到问题中,但似乎并不难,我错过了什么
-
越来越近了?
标签: scala apache-spark rdd spark-graphx