【问题标题】:Running Spark Applications Using IPython and Jupyter Notebooks使用 IPython 和 Jupyter Notebooks 运行 Spark 应用程序
【发布时间】:2017-07-11 14:09:11
【问题描述】:

我正在尝试使用 these instructions 安装 Jupyter。

我已经安装在 Anaconda 下,当我尝试运行 pyspark 时(来自部分 使用 PySpark 启动笔记本)我收到以下错误:

$ pyspark Traceback(最近一次调用最后一次): 文件“/opt/cloudera/parcels/Anaconda/bin/jupyter”,第 4 行,在 from jupyter_core.command import main ImportError: No module named jupyter_core.command

【问题讨论】:

  • $ pyspark Traceback(最近一次调用最后一次):文件“/opt/cloudera/parcels/Anaconda/bin/jupyter”,第 4 行,在 from jupyter_core.command import main ImportError: No名为 jupyter_core.command 的模块
  • 如果你在终端输入jupyter notebook,它会打开jupyter吗?
  • 不,找不到命令
  • 必须使用 cloudera 吗?
  • 我们使用 Cloudera Parcels 并安装了 Anaconda,随后在文档中安装和配置 Jupyter

标签: hadoop pyspark


【解决方案1】:

在特定目录中创建脚本并执行将使用pyspark登录jupyte

!/bin/bash

导出 PYSPARK_DRIVER_PYTHON=/opt/cloudera/parcels/Anaconda/bin/jupyter 导出 PYSPARK_DRIVER_PYTHON_OPTS="notebook --NotebookApp.open_browser=False --NotebookApp.ip='*' --NotebookApp.port=8880" 导出 PATH=/opt/cloudera/parcels/Anaconda/bin:$PATH pyspark

转到http://host-name:8880/

【讨论】:

    猜你喜欢
    • 2016-01-13
    • 2012-06-14
    • 2013-09-15
    • 1970-01-01
    • 2015-11-21
    • 2020-10-11
    • 2016-12-24
    • 2017-01-11
    相关资源
    最近更新 更多