【发布时间】:2017-12-07 00:36:12
【问题描述】:
我已经从输入文件中加载了一个表格。
CREATE TABLE MyTable (
ID INT,
VALUE FLOAT,
RATE INT
...
LOAD DATA LOCAL INPATH 'MYPATH' INTO TABLE MyTable;
现在我想基于这个创建一个新的
DerivedTable =
SELECT ID, VALUE*RATE AS Total
FROM MyTable
WHERE VALUE IS NOT NULL;
然后我将使用此表作为其他表和输出的源。
创建这个“临时”表的正确 Sql(或 Hive)方法是什么?这应该在spark-sql 中工作?
PS:我知道如何在 spark-shell 中做到这一点。但这不是我想要的。
【问题讨论】:
标签: apache-spark apache-spark-sql hiveql