【发布时间】:2019-02-22 20:10:32
【问题描述】:
我正在尝试从父数据框创建子数据框。但我有 100 多个列可供选择。 那么在 Select 语句中我可以给出文件中的列吗?
val Raw_input_schema=spark.read.format("text").option("header","true").option("delimiter","\t").load("/HEADER/part-00000").schema
val Raw_input_data=spark.read.format("text").schema(Raw_input_schema).option("delimiter","\t").load("/DATA/part-00000")
val filtered_data = Raw_input_data.select(all_cols)
如何从 all_cols 中的文件发送列名
【问题讨论】:
标签: scala apache-spark apache-spark-sql