【问题标题】:Persisting to Kerberized HDFS from Spark cluster从 Spark 集群持久化到 Kerberized HDFS
【发布时间】:2019-05-12 04:05:29
【问题描述】:

我目前的设置:

  • Spark 版本 2.3.1(在 Windows 上运行的集群)使用 Spark 密钥(基本)。
  • Hdfs(在 Linux 上运行的集群)Kerberized。

不理想!但是我不能为两个集群使用同一组机器是有充分理由的。

我能够从独立的 Spark 应用程序读取/写入 Hdfs,但是当我尝试在 Spark 集群上运行类似代码时,我收到了身份验证错误。

java.io.IOException:本地异常失败:java.io.IOException: org.apache.hadoop.security.AccessControlException:客户端不能 通过:[TOKEN,KERBEROS] 进行身份验证;主机详情....

【问题讨论】:

  • 传递 keytab 和 pricipal。 --conf keytab=path_to_keytab --conf principal=xxxxxxx
  • 感谢 Kishore,不幸的是已经完成了,但仍然没有运气!在独立模式下运行良好,但在集群模式下运行良好。

标签: apache-spark authentication hdfs kerberos


【解决方案1】:

您的另一个集群节点在哪里?哪个用户在集群模式下运行 spark?该用户是否有权访问密钥表?我认为这可能是权限问题或一些错字。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2017-04-17
    • 2015-09-02
    • 1970-01-01
    • 2020-10-23
    • 1970-01-01
    • 1970-01-01
    • 2022-11-11
    • 2016-01-16
    相关资源
    最近更新 更多