【发布时间】:2018-06-13 06:45:11
【问题描述】:
如今,数据具有大量特征。为了获得数据的简短摘要,人们将数据加载到数据框中并使用head() 方法来显示它。使用 Jupyter Notebooks(使用 Toree for scala)运行实验是很常见的。
Spark (scala) 适合处理大量数据,但其head() 方法不会在水平滚动的笔记本中显示列标题。
我知道您可以使用 .columns 在 scala 数据框中获取列标题,但打印它不会沿数据列显示标题,因此难以理解。
【问题讨论】:
标签: scala pandas apache-spark apache-spark-sql jupyter-notebook