【发布时间】:2020-04-16 21:11:27
【问题描述】:
我正在尝试将 pyspark 代码转换为 spark Scala,但遇到以下错误:
pyspark 代码
import pyspark.sql.functions as fn
valid_data = bcd_df.filter(fn.lower(bdb_df.table_name)==tbl_nme)
.select("valid_data").rdd
.map(lambda x: x[0])
.collect()[0]
从bcd_df 数据框我得到一个带有table_name 的列,并将table_name 的值与我传递的参数tbl_name 匹配,然后选择valid_data 列数据。
这是 spark scala 中的代码。
val valid_data =bcd_df..filter(col(table_name)===tbl_nme).select(col("valid_data")).rdd.map(x=> x(0)).collect()(0)
错误如下:
Exception in thread "main" org.apache.spark.sql.AnalysisException: cannot resolve '`abcd`' given input
columns:
Not sure why it is taking abcd as column.
感谢任何帮助。
【问题讨论】:
标签: scala2.11.8 spark2.3 scala apache-spark pyspark apache-spark-sql