【发布时间】:2018-08-08 20:01:21
【问题描述】:
我是数据科学的新手,正在寻求帮助。
我想从结构化流数据帧构建 Spark ML 管道模型,但遇到了一些错误。请看下面的代码 sn-p 和错误信息。
注意:我们已经离线训练了我们的模型,只是想从结构化流数据帧构建评分模型。
代码:
pipelineModel= PipelineModel.load('/model/path/')
scoringDf = pipelineModel.transform(streamingDf)
错误信息:
Py4JJavaError: An error occurred while calling o1910.transform.
: org.apache.spark.sql.AnalysisException: Queries with streaming sources must be executed with writeStream.start();;
Kafka
我们使用的是 DSE Cassandra v 6.0,它具有 Spark 2.2.1。那么有人会建议将预训练的 PipelineML 对象转换为 Spark 2.2 中的流数据帧的问题吗?
请给我一些意见。
【问题讨论】:
标签: python pyspark apache-spark-sql data-science apache-spark-ml