【发布时间】:2021-05-09 12:34:31
【问题描述】:
我在 sqoop 中看到要导入表,我们有 import-all-tables 或只是将表名导入 hive 但我有 100 个表,我只想导入一次两张桌子, 我怎样才能做到这一点?
【问题讨论】:
-
使用一个 shell 脚本,它会从 100 个列表中选择,然后使用循环它会一次运行 2 个。
标签: apache-spark hadoop hive bigdata sqoop
我在 sqoop 中看到要导入表,我们有 import-all-tables 或只是将表名导入 hive 但我有 100 个表,我只想导入一次两张桌子, 我怎样才能做到这一点?
【问题讨论】:
标签: apache-spark hadoop hive bigdata sqoop
你可以这样写一个 shell 脚本:
while read line;
do
DBNAME=`echo $line | cut -d'.' -f1`
tableName=`echo $line | cut -d'.' -f2`
sqoop import -Dmapreduce.job.queuename=$QUEUE_NAME --connect '$JDBC_URL;databaseName=$DBNAME;username=$USERNAME;password=$PASSWORD' --table $tableName --target-dir $DATA_COLLECTOR/$tableName --fields-terminated-by '\001' -m 1
done<inputFile
【讨论】: