【发布时间】:2020-07-02 15:22:24
【问题描述】:
可能是一个愚蠢的问题,但我不明白。我正在使用 Python3.6、Spark 2.4 开发 Jupyter Notebook,由 IBM Watson Studio 托管。
我有一个简单的 csv 文件:
num,label
0,0
1,0
2,0
3,0
为了阅读它,我使用以下命令:
labels = spark.read.csv(url, sep=',', header=True)
但是如果我检查labels 是否正确,使用labels.head(),我会得到Row(PAR1Љ��L�Q�� ='\x08\x00]')
我错过了什么?
【问题讨论】:
标签: csv pyspark data-science-experience