【发布时间】:2020-08-13 02:36:45
【问题描述】:
我是Big Data 的新手,所以Hadoop 和hdfs 现在对我来说有点消失了,所以我寻求帮助。
现在我有 4 个csv 格式的文件,它们位于HDFS 集群中,我应该使用Python 以PARQUET 格式制作它们的4 个副本,但我不知道如何制作它。
我希望你能帮助我解决这个不难的问题。
【问题讨论】:
-
欢迎来到 StackOverflow!请添加您迄今为止尝试过的内容以及您遇到的具体问题!我们不是来解决您的任务,而是解决一个特定问题!
标签: python csv hadoop hdfs parquet