【发布时间】:2020-04-08 21:58:54
【问题描述】:
我目前正在使用 spark(scala) 在 Apache Hudi 上进行 POC。
我在使用分区保存数据帧时遇到问题。
Hudi 使用path/valueOfPartitionCol1/valueOfPartitionCol2.... 保存数据帧
使用属性PARTITIONPATH_FIELD_OPT_KEY。
但我的要求是 path/COL1=value/COL2=value.... 类似于 spark 使用 partitionBy() 对数据进行分区的方式。
任何尝试过使用Hudi 进行自定义分区的人可以帮助我吗?
【问题讨论】: