【问题标题】:How to load a Kmeans model in Pyspark? I am getting an error while loading如何在 Pyspark 中加载 Kmeans 模型?加载时出现错误
【发布时间】:2019-02-21 03:25:28
【问题描述】:

我正在尝试加载我之前使用 pyspark.ml.clustering 库保存的 Kmeans 模型。 我正在使用以下命令来加载文件:

model = KMeansModel.load(sc,"KMeans_15thSept_4000")

但是,我收到以下错误:

"File "/usr/lib/spark/python/lib/py4j-0.10.4-src.zip/py4j/protocol.py", line 319, in get_return_value
py4j.protocol.Py4JJavaError: An error occurred while calling z:org.apache.spark.mllib.clustering.KMeansModel.load.
: org.json4s.package$MappingException: Did not find value which can be converted into java.lang.String"

【问题讨论】:

    标签: pyspark k-means distributed


    【解决方案1】:

    您已经使用 pyspark.ml.clustering 库保存了您的模型,并且正在使用 pyspark.mllib.clustering 库加载您的模型。根据thread,这必然会引发错误。要加载模型,您必须执行以下操作 -

    from pyspark.ml.clustering import KMeansModel
    
    model = KMeansModel.load(save_path_to_model)
    
    

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2022-06-21
      • 2012-03-04
      • 1970-01-01
      • 1970-01-01
      • 2017-12-27
      • 2017-06-12
      • 1970-01-01
      相关资源
      最近更新 更多