【发布时间】:2014-02-11 08:42:27
【问题描述】:
我正在尝试运行如下所示的作业 (workflow.xml)
<workflow-app name="FirstWorkFlow" xmlns="uri:oozie:workflow:0.2">
<start to="FirstJob"/>
<action name="FirstJob">
<pig>
<job-tracker>hadoop1:50300</job-tracker>
<name-node>hdfs://hadoop1:8020</name-node>
<script>lib/FirstScript.pig</script>
</pig>
<ok to="end"/>
<error to="kill"/>
</action>
<kill name="kill">
<message>Action failed, error message[${wf:errorMessage(wf:lastErrorNode())}]</message>
</kill>
<end name="end" />
</workflow-app>
第一脚本:
dual = LOAD 'default.dual' USING org.apache.hcatalog.pig.HCatLoader();
store dual into '/user/oozie/dummy_file.txt' using PigStorage();
job.properties:
nameNode=hdfs://hadoop1:8020
jobTracker=hadoop1:50300
oozie.wf.application.path=/user/oozie/FirstScript
oozie.use.system.libpath=true
我的问题是:我需要在 job.properies 和 workflow.xml 中都提供 nameNode 和 jobTracker 配置吗?
我很困惑,因为无论我是否设置了这些参数,我都会收到这个错误(来自hue界面的错误):
E0902: Exception occured: [Call to localhost/127.0.0.1:8020 failed on connection exception: java.net.ConnectException: Connection refused]
问候 帕维尔
【问题讨论】:
-
尝试将 job.properties 更改为:oozie.wf.application.path=hdfs://hadoop1:8020/user/oozie/FirstScript
-
默认情况下,大部分 Jobtracker 在 8021 上运行。同时尝试将您尝试的 jobtracker URL 放在浏览器中以查看响应。例如:
http://hadoop1:50030主机名最好是hostname -f输出
标签: hadoop apache-pig oozie