【发布时间】:2018-07-15 07:51:58
【问题描述】:
在 PySpark 中使用 lamdba 函数有什么好处?这是一个例子:
def square(x):
return float(x**2)
使用 lambda,我尝试了这个:
f_square = udf(lambda x: square(x), FloatType())
result_w_square = result.withColumn('square', f_square(result.x))
没有 lambda,我试过这个:
f_square = udf(square, FloatType())
result_w_square2 = result.withColumn('square', f_square(result.x))
我得到了同样的结果。哪种方法更好?
【问题讨论】: