【发布时间】:2015-09-30 10:13:57
【问题描述】:
我已在多节点集群(1 个名称节点和 4 个数据节点)上成功运行 Hadoop 2.7.1。但是,当我运行 MapReduce 作业(来自 Hadoop 网站的 WordCount 示例)时,它总是卡在这一点上。
[~@~ hadoop-2.7.1]$ bin/hadoop jar WordCount.jar WordCount /user/inputdata/ /user/outputdata
15/09/30 17:54:56 WARN util.NativeCodeLoader: Unable to load native-hadoop library for your platform... using builtin-java classes where applicable
15/09/30 17:54:57 INFO client.RMProxy: Connecting to ResourceManager at /0.0.0.0:8032
15/09/30 17:54:58 WARN mapreduce.JobResourceUploader: Hadoop command-line option parsing not performed. Implement the Tool interface and execute your application with ToolRunner to remedy this.
15/09/30 17:54:59 INFO input.FileInputFormat: Total input paths to process : 1
15/09/30 17:55:00 INFO mapreduce.JobSubmitter: number of splits:1
15/09/30 17:55:00 INFO mapreduce.JobSubmitter: Submitting tokens for job: job_1443606819488_0002
15/09/30 17:55:00 INFO impl.YarnClientImpl: Submitted application application_1443606819488_0002
15/09/30 17:55:00 INFO mapreduce.Job: The url to track the job: http://~~~~:8088/proxy/application_1443606819488_0002/
15/09/30 17:55:00 INFO mapreduce.Job: Running job: job_1443606819488_0002
我必须为yarn 指定内存吗?
注意:DataNode 硬件非常老旧(每个都有 1GB RAM)。
感谢您的帮助。 谢谢。
【问题讨论】:
-
很难看出你工作的真正问题是什么。请发布纱线日志的输出。是的,您需要为纱线指定内存。你有没有配置它?
-
@facha 我已经按照 Hadoop 网站的建议配置了
yarn和mapredxmls。现在,我将尝试使用我的.log进行编辑。
标签: hadoop mapreduce hadoop-yarn hadoop2