【发布时间】:2015-03-05 18:33:58
【问题描述】:
我正在尝试从 Spark RDD 中获取最后一个元素信息。
我已经用 (key, value) 对的值对 RDD 进行了排序。
我在 RDD 中的数据
(8, 0.98772733936789858)
(4, 3.0599761935471004)
(2, 3.1913934060593321)
(1, 4.9646263295153013)
(5, 5.3596802463208792)
(7, 5.5829277439661071)
(9, 6.4739040233992258)
(0, 6.9343681509951081)
(6, 7.4699692671955953)
(3, 8.6579764626088771)
我能够使用第一个函数获得第一个 (key, value) 对,但无法弄清楚如何获得最后一个。我可以将(key, value) 对交换为(value, key) 对并使用 .max 函数获取所需的数据。但是,有没有其他方法可以使用 Python spark 从 RDD 中获取最后一个元素?
【问题讨论】:
标签: apache-spark rdd