【问题标题】:On which hadoop node would the below scalding pre-process and post-process runs?下面的烫伤预处理和后处理将在哪个 hadoop 节点上运行?
【发布时间】:2015-08-26 23:18:26
【问题描述】:

我有下面的example 代码,用于在 sclading 作业运行和一些后期处理之前进行一些预处理。由于这些预处理和后处理正在调用一些 mysql 数据库,我想知道 hadoop 可能会在哪些 hadoop 节点上运行它们? (我需要打开从这些节点到数据库的端口)它可以运行任何hadoopdata-node 的预处理和后处理吗?我尝试进行一些研究,但找不到任何迹象,如何通过文档/来源找到它将在哪个节点上运行? (PS 作业是用oozie 安排的)

  preProcessingBeforeJobRuns() // **in which hadoop node would this be run? could it run on any datanode?**
  log.info(s"ABOUT TO RUN JOB with input $jobInput")
  val scaldingTool = new Tool
  scaldingTool.setJobConstructor(createJob(jobInput))
  val parser: GenericOptionsParser = new GenericOptionsParser(new Configuration(), args)
  scaldingTool.setConf(parser.getConfiguration)
  log.info(s"CALLING SCALDING RUN with args: ${args.toList.mkString(" ")}")
  val status = scaldingTool.run(args)
  log.info("FINISHED RUNNING JOB!")
  somePostJobProcessing() // **in which hadoop node would this be run? could it run on any datanode?**

【问题讨论】:

    标签: scala hadoop scalding


    【解决方案1】:

    您发布的代码将在 Hadoop 主节点上运行。 scaldingTool.run(args) 将触发您的作业,这将触发在任务节点上执行的作业。

    【讨论】:

      猜你喜欢
      • 2013-08-01
      • 2014-04-14
      • 2010-11-01
      • 2012-03-11
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2020-01-07
      • 2014-06-19
      相关资源
      最近更新 更多