hadoop的mapreduce过程中,map会在文件block所在的datanode执行还是将文件数据传输到空闲datanode执行?

 我来答
霜龙龙
2015-05-08
知道答主
回答量:0
采纳率:0%
帮助的人:0
展开全部
job提交后,MRAppMaster会向yarn的ResourceManager申请资源(CPU,内存),MRAppMaster申请到资源后会与资源所在的NodeManager通信,要求其启动任务,NodeManager会为任务配置好环境(环境变量,jar包等),然后运行任务。
至于input会被input split分解成map个数量的独立输入,根据选择主机的算法,到选择的主机上
追问
能具体说下选择主机的算法吗?是数据所在的节点优先还是资源占用率低的节点优先?
追答
当一个分片包含的多个block的时候,总会从其他节点读取数据,也就是做不到所有的计算都是本地化。为了发挥计算本地化性能,应该尽量使InputSplit大小与块大小相当
推荐律师服务: 若未解决您的问题,请您详细描述您的问题,通过百度律临进行免费专业咨询
?>

为你推荐:

下载百度知道APP,抢鲜体验
使用百度知道APP,立即抢鲜体验。你的手机镜头里或许有别人想知道的答案。
扫描二维码下载
×

类别

我们会通过消息、邮箱等方式尽快将举报结果通知您。

说明

0/200

提交
取消

辅 助

模 式