【发布时间】:2018-10-04 16:50:33
【问题描述】:
如何使用 Python 在 Spark 中读写压缩的SequenceFile。
我在带有 Python 2.7 的 CDH 5.12 Quickstart VM 上使用 Spark 1.6
找到如下示例,但不起作用。
rdd.saveAsSequenceFile(<path location>, Some(classOf[compressionCodecClass]))
sparkContext.sequenceFile(<path location>,
classOf[<class name>],
classOf[<compressionCodecClass >]);
需要工作代码进行测试。
【问题讨论】:
标签: pyspark compression sequencefile