【发布时间】:2019-01-14 00:29:08
【问题描述】:
我有一个单列的 PySpark 数据框。
| Rank
|----------
| 10
| 10
| null
| null
| 15
| null
| 20
| null
| null
| 15
| null
| 10
我想使用 pandas ffill() 函数之类的前向填充来估算缺失值。
期望的输出
| Rank
|----------
| 10
| 10
| 10
| 10
| 15
| 15
| 20
| 20
| 20
| 15
| 15
| 10
免责声明:我在 stackoverflow 中有一些解决方案,但是当您只有一列作为输入时,它们将不起作用。
【问题讨论】:
标签: python apache-spark pyspark apache-spark-sql pyspark-sql