【发布时间】:2016-08-26 18:56:42
【问题描述】:
我正在编写一个 Scala 代码,该代码需要我写入 HDFS 中的文件。
当我在本地使用Filewriter.write 时,它可以工作。同样的事情在 HDFS 上不起作用。
经过检查,我发现在 Apache Spark 中可以编写以下选项-
RDD.saveAsTextFile 和 DataFrame.write.format。
我的问题是:如果我只想将 int 或字符串写入 Apache Spark 中的文件怎么办?
跟进:
我需要向输出文件写入标题、DataFrame 内容,然后附加一些字符串。
sc.parallelize(Seq(<String>)) 有帮助吗?
【问题讨论】:
标签: scala hadoop apache-spark filewriter