【问题标题】:JRI from Hive UDF / UDAF来自 Hive UDF / UDAF 的 JRI
【发布时间】:2013-05-29 18:33:03
【问题描述】:

我在一些数据节点上安装了 R,可以编写 Map reduce 作业通过 JRI 调用 R。

接下来,为了通过配置单元查询调用 R,我重写了 GenericUDAFEvaluator 中的 terminate 方法并在那里创建 Rengine 对象。

以前的 mapred 工作要求我先完成-Dmapred.child.env="R_HOME=/usr/lib64/R" 才能工作。

当我在 hive 中执行此操作(通过 set mapred.child.env="R_HOME=/usr/lib64/R"; )然后运行查询时,作业在设置时失败。

更一般地说,这从 hive 成功:

 select count(*) from some_table limit 10;

但这失败了:

 set mapred.child.env='abc=pqr';
 select count(*) from some_table limit 10;

我有hive-hwi-0.9.0-cdh4.1.1.jar 和hadoop-2.0.0-cdh4.1.1

【问题讨论】:

    标签: r hadoop hive rjava


    【解决方案1】:

    我从 set 语句中删除了引号,它起作用了。这样做:

    set mapred.child.env=abc=pqr;

    select count(*) from some_table limit 10;

    这行得通

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2023-03-12
      • 1970-01-01
      • 1970-01-01
      • 2016-12-25
      • 2016-01-27
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多