【发布时间】:2018-02-24 09:37:09
【问题描述】:
我们知道,默认的最小容器大小是1024MB
考虑这个场景:
我已经在 VIRTUAL BOX 中设置了一个 Hadoop 集群 1-Master & 3-Datanodes>。
Namenode:主节点(3GB RAM)
数据节点:data1 (512MB RAM),data2(512MB RAM),data3(1GB RAM)。
输入文件大小:500MB with Replication factor 3(所有节点具有所有块)
问题:
1. 现在假设我想运行一个 Mapreduce 程序,容器会在 data1、data2 上分配吗?
根据我的结果,Job 在所有三个数据节点上都创建了容器。
2. 有什么方法可以指定作业在特定节点上运行?
【问题讨论】:
标签: hadoop mapreduce containers