【问题标题】:spark-submit error: Invalid maximum heap size: -Xmx4g --jars, but enough of memory on the systemspark-submit 错误:最大堆大小无效:-Xmx4g --jars,但系统上有足够的内存
【发布时间】:2020-02-11 00:42:06
【问题描述】:

我正在运行 Spark 作业:

spark-submit --master spark://ai-grisnodedev1:7077 --verbose --conf spark.driver.port=40065 --driver-memory 4g
--jars /opt/seqr/.conda/envs/py37/lib/python3.7/site-packages/hail/hail-all-spark.jar 
--conf spark.driver.extraClassPath=/opt/seqr/.conda/envs/py37/lib/python3.7/site-packages/hail/hail-all-spark.jar 
--conf spark.executor.extraClassPath=./hail-all-spark.jar ./hail_scripts/v02/convert_vcf_to_hail.py ./hgmd_pro_2019.4_hg38.vcf -ht 
--genome-version 38 --output ./hgmd_pro_2019.4_hg38.ht

命令报错:

最大堆大小无效:-Xmx4g --jars 错误:无法创建 Java 虚拟机。 错误:发生了致命异常。程序将退出。

我检查了内存:

所以,看起来还不错。我查了java

(py37) -bash-4.2$ java -version
openjdk version "1.8.0_232"
OpenJDK Runtime Environment (build 1.8.0_232-b09)
OpenJDK 64-Bit Server VM (build 25.232-b09, mixed mode)

然后我检查了Chrome spark 是否在ai-grisnodedev1:7077 上运行,并且它与一名工人一起运行。如果我使用ipython,我可以在https://hail.is/docs/0.2/getting_started.html 运行简单的install 示例:

import hail as hl
mt = hl.balding_nichols_model(n_populations=3, n_samples=50, n_variants=100)
mt.count()

所以,依赖于SparkHail 也在工作。也许我的命令格式不正确或某些文件已损坏?但是该错误非常具有误导性。我可以做些什么来尝试调试这个问题?

【问题讨论】:

    标签: java apache-spark hail


    【解决方案1】:

    刚刚发布了问题并立即修复了它,尽管非常绝望。问题是我在几个编辑器中复制粘贴命令并返回,--driver-memory 4g 之后可能存在一些错误字符。我刚刚删除了空格(可能不是空格)并重新插入它们,它就开始工作了。很难说为什么,也许tabnewline 以某种方式搞砸了。我正在使用Microsoft One Note - 也许它正在对空格进行一些修改......

    【讨论】:

      【解决方案2】:

      我也有这个问题。无论如何,我使用的是pySpark。 对我来说,这是spark.executor.memory 接受的问题,例如16gb,而 spark.driver.memoryonly 接受 16g-> gb 中的 b 导致错误(有点不直观说实话)。

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 1970-01-01
        • 2020-07-09
        • 1970-01-01
        • 1970-01-01
        • 2017-08-14
        • 1970-01-01
        • 1970-01-01
        • 2015-02-12
        相关资源
        最近更新 更多