Hadoop之完全分布式集群

发布时间：2019-09-28 01:24:59 所属栏目：优化来源：kocdaniel

导读：首先准备三台客户机(hadoop102，hadoop103，hadoop104)，关闭防火墙，修改为静态ip和ip地址映射配置集群编写集群分发脚本创建一个远程同步的脚本xsync，并放到当前用户下新建的bin目录下，配置到PATH中，使得此脚本在任何目录下都可以执行脚本实现 [ko

配置yarn-env.sh

[kocdaniel@hadoop102 hadoop]$ vim yarn-env.sh 
export JAVA_HOME=/opt/module/jdk1.8.0_144

配置yarn-site.xml

[kocdaniel@hadoop102 hadoop]$ vi yarn-site.xml 
# 增加如下配置 
<!-- Reducer获取数据的方式 --> 
<property> 
        <name>yarn.nodemanager.aux-services</name> 
        <value>mapreduce_shuffle</value> 
</property> 
 
<!-- 指定YARN的ResourceManager的地址 --> 
<property> 
        <name>yarn.resourcemanager.hostname</name> 
        <value>hadoop103</value> 
</property>

MapReduce配置文件

配置mapred-env.sh

[kocdaniel@hadoop102 hadoop]$ vim mapred-env.sh 
export JAVA_HOME=/opt/module/jdk1.8.0_144

配置mapred-site.xml

# 如果是第一次配置的话，需要先将mapred-site.xml.template重命名为mapred-site.xml 
[kocdaniel@hadoop102 hadoop]$ cp mapred-site.xml.template mapred-site.xml 
[kocdaniel@hadoop102 hadoop]$ vim mapred-site.xml 
# 在文件中增加如下配置 
<!-- 指定MR运行在Yarn上 --> 
<property> 
        <name>mapreduce.framework.name</name> 
        <value>yarn</value> 
</property>

3.将配置好的文件利用集群分发脚本同步到hadoop103和hadoop104节点

[kocdaniel@hadoop102 hadoop]$ xsync /opt/module/hadoop-2.7.2/

最好在同步完成之后检查一下同步结果，避免错误

单点启动

1.如果是第一次启动，需要格式化namenode，否则跳过此步

[kocdaniel@hadoop102 hadoop-2.7.2]$ hadoop namenode -format

格式化需要注意的问题：

只有第一次启动需要格式化，以后不要总是格式化，否则会出现namenode和datanode的集群id不一致的情况，导致datanode启动失败
正确的格式化姿势：

在执行第一次格式化时会在hadoop安装目录下产生data文件夹，里面会生成namenode的信息
在启动namenode和datanode后，还会在同样的目录下产生logs的日志文件夹
所以在格式化之前需要先将这两个文件夹删除，然后再格式化，最后启动namenode和datanode

2.在hadoop102上启动namenode

[kocdaniel@hadoop102 hadoop-2.7.2]$ hadoop-daemon.sh start namenode 
[kocdaniel@hadoop102 hadoop-2.7.2]$ jps 
3461 NameNode

3.在hadoop102、hadoop103以及hadoop104上分别启动DataNode

[kocdaniel@hadoop102 hadoop-2.7.2]$ hadoop-daemon.sh start datanode 
[kocdaniel@hadoop102 hadoop-2.7.2]$ jps 
3461 NameNode 
3608 Jps 
3561 DataNode 
[kocdaniel@hadoop103 hadoop-2.7.2]$ hadoop-daemon.sh start datanode 
[kocdaniel@hadoop103 hadoop-2.7.2]$ jps 
3190 DataNode 
3279 Jps 
[kocdaniel@hadoop104 hadoop-2.7.2]$ hadoop-daemon.sh start datanode 
[kocdaniel@hadoop104 hadoop-2.7.2]$ jps 
3237 Jps 
3163 DataNode

4.访问hadoop102:50070查看结果

但是以上单点启动有一个问题：

每次都一个一个节点启动，如果节点数增加到1000个怎么办?

配置ssh免密登录

1.配置ssh

ssh 另一个节点的ip 就可以切换到另一台机器，但是得输入密码

2.免密ssh配置

免密登录原理

Hadoop之完全分布式集群

在配置namenode的主机hadoop102上生成私钥和公钥

（编辑：牡丹江站长网）

【声明】本站内容均来自网络，其相关言论仅代表作者个人观点，不代表本站立场。若无意侵犯到您的权利，请及时与联系站长删除相关内容!

3/5

首页

尾页

SEO人员经常难以回答	如何短期创造PC端与
SEO一句话经典语录值	百度站点品牌展现上架