【问题标题】:hadoop streaming jobs fails to report?hadoop 流式作业无法报告?
【发布时间】:2011-10-31 06:04:58
【问题描述】:

所有作业都使用 hadoop-streaming 成功运行,但突然之间我开始看到由于一台工作机器导致的错误

Hadoop job_201110302152_0002 failures on master

Attempt Task    Machine State   Error   Logs
attempt_201110302152_0002_m_000037_0    task_201110302152_0002_m_000037 worker2 FAILED  
Task attempt_201110302152_0002_m_000037_0 failed to report status for 622 seconds. Killing!
-------
Task attempt_201110302152_0002_m_000037_0 failed to report status for 601 seconds. Killing!
Last 4KB
Last 8KB
All

问题:

- Why does this happening ?  
- How can I handle such issues?  

谢谢

【问题讨论】:

    标签: hadoop mapreduce hadoop-streaming


    【解决方案1】:

    mapred.task.timeout 默认为 600 秒的描述是“如果任务既不读取输入、不写入输出也不更新其状态字符串,任务将被终止前的毫秒数。”

    增加mapred.task.timeout的值可能会解决问题,但你需要弄清楚map任务是否真的需要超过600s才能完成处理输入数据,或者代码中是否存在错误需要调试。

    根据 Hadoop 最佳实践,地图任务平均需要一分钟左右来处理 InputSplit。

    【讨论】:

    • 谢谢 Praveen,我会检查一下并告诉你
    猜你喜欢
    • 2012-10-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多