【问题标题】:Error in saving Random Forest Classifier model in Pyspark在 Pyspark 中保存随机森林分类器模型时出错
【发布时间】:2018-06-03 22:04:26
【问题描述】:
rf = RandomForestClassifier().setFeaturesCol("features").setLabelCol("label")
pipeline = Pipeline(stages=[tokenizer, hashingTF, idf, rf])
model = pipeline.fit(training) 
model.save(sc, '<path_to_save>')

我正在尝试使用上面的代码保存模型文件。但是出现意外错误 -

TypeError: save() takes exactly 2 arguments (3 given)

我不明白这个错误。我只传递了 2 个参数,但仍然收到此错误。 有人知道吗?我在这里做错了什么?

【问题讨论】:

    标签: pyspark random-forest apache-spark-ml


    【解决方案1】:

    我不知道这是如何工作的。但是删除第一个字段“sc”对我有用。

    model.save('<path_to_save>')
    

    我可以通过这个命令保存模型文件。

    【讨论】:

    • 为什么不解?这是正确的方法,根据docs。此外,您显然指的是 Spark ML,而不是 MLlib(已编辑标签)。
    • 我遇到了同样的问题,但它不起作用!有什么想法吗?
    猜你喜欢
    • 2016-07-23
    • 2020-02-02
    • 2015-11-11
    • 2018-02-18
    • 2022-01-25
    • 2013-12-12
    • 2018-05-20
    • 2020-01-16
    • 2021-09-29
    相关资源
    最近更新 更多