【发布时间】:2020-12-07 07:43:24
【问题描述】:
我想创建一个带有多个任务管理器的 Apache Flink 独立集群。我想使用 HDFS 和 Hive。因此我必须添加一些 Hadoop 依赖项。
阅读documentation 后,推荐的方法是设置 HADOOP_CLASSPATH 环境变量。但是我必须如何添加 hadoop 文件?我应该在任务管理器上的 /opt/hadoop 之类的目录中下载源文件并将变量设置为此路径吗?
我只知道下载带有依赖项的 Uber-Jar 并将其放在 /lib 文件夹下的旧但已弃用的方法。
【问题讨论】:
标签: apache-flink