【发布时间】:2013-08-20 23:06:34
【问题描述】:
我正在尝试从 Teradata 中提取数据并将其放入 hadoop。
我为此编写了一个脚本。
这不是一个直接的过程。
staged到Hadoop的本地,然后放到Hadoop中。
运行脚本时出现以下错误:
0002 .LOGTABLE 日志_1; **** 16:06:28 UTY1006 CLI 错误:235,MTDP:EM_GSSINITFAIL(235):调用 gss_init 失败。 **** 16:06:28 UTY2410 使用的总处理器时间 = '0 秒' .开始 : 16:06:28 - 2013 年 8 月 20 日星期二 .结束 : 16:06:28 - 2013 年 8 月 20 日星期二 .遇到的最高返回码 = '12'。谁能帮助我,告诉我这里的错误是什么?这个错误是什么意思?
【问题讨论】:
-
在从 Teradata 卸载数据负载以在其他地方处理之前:考虑通过 JDBC 将 Hadoop 作业连接到 Teradata,然后在需要时阅读所需内容。所有 Bi 和 Etl 工具供应商都以这种方式进行了优化(他们给它起了花哨的名称,例如下推或数据库内),这样您就可以利用 Teradata 的完全并行性并最大限度地减少网络上的流量。为什么不使用贵公司支付的费用?
-
致 @jboi 的评论 - Teradata 确实提供了 Hadoop 和 Teradata 之间的连接器,这可能有助于促进您想要完成的工作。您不妨与客户代表交谈。
-
您可以找到有关 Teradata / Hadoop 连接器 here 的更多信息。我不知道它是否需要许可费,或者您可以在 developer.teradata.com 上下载它。
标签: teradata