【发布时间】:2021-10-11 15:37:50
【问题描述】:
我有像s3://bucket-name/folder-parquet/ 这样的 S3 位置。
我想从这个位置获取所有文件名并将其保存在一个数组中。
所以如果我们在s3://bucket-name/folder-parquet/ 有part-0000.parquet、part-0001.parquet 之类的文件,那么我的数组应该是:
array = ['part-0000.parquet','part-0001.parquet']
【问题讨论】:
标签: scala apache-spark amazon-s3 apache-spark-sql