如何让hadoop集群分布式计算

 我来答

1个回答

#热议# 为什么说不要把裤子提到肚脐眼？

护肤达人IT宅族
2016-08-15 · 知道合伙人互联网行家

护肤达人IT宅族
知道合伙人互联网行家

采纳数：5637 获赞数：17441

毕业于曲阜师范大学，学士学位。互联网行业2年从业经验，读过SEO相关书籍。现任爱家网SEO优化专员。

向TA提问私信TA

关注

展开全部

Hadoop是Apache软件基金会旗下的一个开源分布式计算平台。以Hadoop分布式文件系统（HDFS，Hadoop Distributed Filesystem）和MapReduce（Google MapReduce的开源实现）为核心的Hadoop为用户提供了系统底层细节透明的分布式基础架构。
对于Hadoop的集群来讲，可以分成两大类角色：Master和Salve。一个HDFS集群是由一个NameNode和若干个DataNode组成的。其中NameNode作为主服务器，管理文件系统的命名空间和客户端对文件系统的访问操作；集群中的DataNode管理存储的数据。MapReduce框架是由一个单独运行在主节点上的JobTracker和运行在每个集群从节点的TaskTracker共同组成的。主节点负责调度构成一个作业的所有任务，这些任务分布在不同的从节点上。主节点监控它们的执行情况，并且重新执行之前的失败任务；从节点仅负责由主节点指派的任务。当一个Job被提交时，JobTracker接收到提交作业和配置信息之后，就会将配置信息等分发给从节点，同时调度任务并监控TaskTracker的执行。
从上面的介绍可以看出，HDFS和MapReduce共同组成了Hadoop分布式系统体系结构的核心。HDFS在集群上实现分布式文件系统，MapReduce在集群上实现了分布式计算和任务处理。HDFS在MapReduce任务处理过程中提供了文件操作和存储等支持，MapReduce在HDFS的基础上实现了任务的分发、跟踪、执行等工作，并收集结果，二者相互作用，完成了Hadoop分布式集群的主要任务。
先决条件
1) 确保在你集群中的每个节点上都安装了所有必需软件：sun-JDK ssh Hadoop。

已赞过 已踩过<

评论收起

快又稳
2024-10-28 广告

Apache基于域名的虚拟主机配置主要涉及到在Apache配置文件中为不同域名指定不同的网站目录和日志路径。配置时，需确保域名已正确指向服务器的IP地址。在Apache的`httpd-vhosts.conf`或类似配置文件中，为每个域名创建... 点击进入详情页

本回答由快又稳提供

推荐律师服务：若未解决您的问题，请您详细描述您的问题，通过百度律临进行免费专业咨询

您可能关注的内容

星火编辑器-与千万TapTap用户，分享你的作品

星火编辑器是一款面向普通用户的游戏创作工具，致力于让个人开发者也能轻松做游戏。点击了解，如何从0开始掌握星火编辑器。

sce.taptap.cn广告

从淘宝入手，开启无忧数据托管之旅

一站式服务，让数据存储轻松上手性价比高，满足从小到大业务扩展

simba.taobao.com广告

分布式存储数据库有哪些-购物就上淘宝，好货挑选更便捷!

精选小众精品，满足您的独特需求。逛淘宝『其它-43』，发现不一样的精彩。

simba.taobao.com广告

如何让hadoop集群分布式计算

您可能关注的内容

其他类似问题

为你推荐：