【发布时间】:2020-11-29 11:26:33
【问题描述】:
只是想知道是否有任何有效的方法来过滤包含值列表的列,例如:
假设我要过滤一个包含牛肉的列,Beef:
我能做到:
beefDF=df.filter(df.ingredients.contains('Beef')|df.ingredients.contains('beef'))
我想创建一个列表,而不是执行上述方式:
beef_product=['Beef','beef']
然后做:
beefDF=df.filter(df.ingredients.contains(beef_product))
我不需要维护代码,只需要在beef_product 列表中添加新的牛肉(例如牛、肋眼)以获得过滤器数据框。
显然contains函数不采用list类型,有什么好的方法来实现呢?
【问题讨论】:
标签: dataframe apache-spark pyspark