【发布时间】:2020-03-04 12:47:29
【问题描述】:
对于研究项目需求,我选择以下技术,因为数据源是SQL SERVER
初始数据大小为 100Gb 和 10 个增长@季度
信息
Hadoop – 多节点集群(1Namenode + 3 DataNode)
Hadoop 3.1.2,
Apache Maven 3.6.0
Ubuntu 18.04
安巴里
上面的设置现在已经准备好了,下面还有剩余的项目
Sqoop:1.4.7 蜂巢:2.3.5 Oozie 5.0.0
它们应该都安装在不同的机器上吗?
开发完成后的部署策略是什么?
【问题讨论】:
标签: hadoop hive sqoop oozie ambari