【发布时间】:2019-08-12 11:07:58
【问题描述】:
我正在使用 spark Word2vec API 来构建词向量。代码:
val w2v = new Word2Vec()
.setInputCol("words")
.setOutputCol("features")
.setMinCount(5)
但是,这个过程太慢了。我检查了火花监视器网站,有两个工作要运行很长时间。
我的电脑环境有24核CPU和100G内存,如何高效使用?
【问题讨论】:
标签: apache-spark apache-spark-mllib