【发布时间】:2019-08-05 07:57:06
【问题描述】:
我的 csv 文件有多行数据,我想根据一个属性将其拆分为多个文件。
beeline -u jdbc:hive2:<MYHOST> -n <USER> -p <PASSWORD> --silent=true --outputformat=csv2 -f <SQL FILE> > result_+%Y%m%d_%H%M%S.csv
ORDER BY ID 的 SQL 代码是从创建单个 CSV 的直线触发的。
希望的结果是在识别出新的ID 后进行拆分,并在文件名中使用该ID。
file_1_ID_XXXX_+%Y%m%d_%H%M%S:
file_2_ID_YYYYY_+%Y%m%d_%H%M%S:
【问题讨论】: