Hadoop 1.2 集群搭建与环境配置

shenhongdb

2016-12-06

关注关注

一、虚拟机环境

注意三台机器均要配置，因为启动时，namenode会启动其它机器。

二、Hadoop环境

hadoop1.2.1

idk7u79-linux-i586.tar.gz

三、开始搭完全分布式hadoop

三台机器，角色配置如下

hostname	角色配置
centos1	namenode
centos2	datanode, secondaryNameNode
centos3	datanode

1、hadoop配置

分别在三台虚拟机内拷贝hadoop-1.2.1.tar.gz，并解压: tar -zxvf hadoop-1.2.1.tar.gz

conf目录文件配置

conf目录下文件	配置项	备注
core-site.xml	<configuration> <property> <name>fs.default.name</name> <value>hdfs://centos:9000</value> </property> <property> <name>hadoop.tmp.dir</name> <value>/opt/hadoop-tmp</value> </property> </configuration>	1、fs.default.name：配置namenode站点地址。需要注意。9000端口是hdfs rpc协议端口，如果从浏览器访问，则是http协议，端口号是50070.例：http://cetnos:50070 2、hadoop.tmp.dir默认配置/tmp/hadoop-${user.name},hadoop文件数据会默认配置在此目录，由于tmp目录，linux重启后自动清空，因此这里对hadoop.tmp.dir进行手动指定。
hadoop-env.sh	export JAVA_HOME=/usr/local/java/jdk1.7.0_79	配置jdk时在系统配置了JAVA_HOME,但是hadoop不认，必须要在这里修改成你现在的路径。
hdfs-site.xml	<configuration> <property> <name>dfs.replication</name> <value>2</value> </property> </configuration>	lock最大附本数，配置2台dataNode,此处填2.
masters	centos1	master文件用来配置secondaryNameNod, 注意是secondaryNameNode,不是nameNode
slaves	centos1 centos2 (一个节点一行)	slaves用来配置dataNode

2、格式化dfs

cd /home/hadoop-1.2/bin/

./hadoop namenode -format (格式化成功后会在/opt/hadoop-tmp/dfs/name/下生成格式化文件)

3、hadoop路径每台机器要保持一致

配置完成后，NameNode机器上输入命令,即可完成hadoopo的hdfs分布式服务的启动。

root@centos bin]# ./start-dfs.sh

4、启动后结果

在浏览器中输入http://｛NameNode IP}:50070即可访问配置的hdfs环境

四、配置中常见问题

1、JAVA_HOME is not set.

错误日志：

root@centos bin]# ./start-dfs.sh

starting namenode, logging to /home/alvin/hadoop-1.2.1/libexec/../logs/hadoop-root-namenode-centos.out

centos1: bash: line 0: cd: /home/alvin/hadoop-1.2.1/libexec/..: No such file or directory

centos2: bash: line 0: cd: /home/alvin/hadoop-1.2.1/libexec/..: No such file or directory

centos2: starting datanode, logging to /opt/hadoop-1.2/libexec/../logs/hadoop-root-datanode-centos2.out

centos1: starting datanode, logging to /usr/hadoop-1.2.1/libexec/../logs/hadoop-root-datanode-centos1.out

centos2: Error: JAVA_HOME is not set.

centos1: Error: JAVA_HOME is not set.

centos1: bash: line 0: cd: /home/alvin/hadoop-1.2.1/libexec/..: No such file or directory

centos1: starting secondarynamenode, logging to /usr/hadoop-1.2.1/libexec/../logs/hadoop-root-secondarynamenode-centos1.out

centos1: Error: JAVA_HOME is not set.

产生原因三种：

(1)、JDK未配置

(2)、hadoop在每台机器路径不一致，会报JAVA_HOME is not set.问题

该问题首先会想到centos1, centos2两台机器JDK环境是否有配置JAVA_HOME，但是查看均已配了JDK环境。

仔细阅读日志，发现问题是No such file or directory

centos1: bash: line 0: cd: /home/alvin/hadoop-1.2.1/libexec/..: No such file or directory

centos2: bash: line 0: cd: /home/alvin/hadoop-1.2.1/libexec/..: No such file or directory

解决方法：hadoop在每台机器配置路径要一致

(3)、hadoop-env.sh里面没有配置JAVA_HOME

解决方法：配置jdk时在系统配置了JAVA_HOME,但是hadoop不认，必须要在这里修改成你现在的路径。

分析原因：

由于centos1下hadoop路径在/home/alvin/hadoop-1.2.1/下，centos2与centos3路径在/opt/hadoop-1.2/下，

启动datanode或secondaryNameNode节点时，报No such file or directory.

可以看到centos2与centos3都是按照centos1机器的hadoop路径去读取文件的。因此报 No such file or directory

2、启动dfs服务时，jps命令查看，NameNode启动，DataNode和SecondaryNameNode未启动。

防火墙未关，输入命令service iptables stop关闭三台机器防火墙

3、org.apache.hadoop.security.AccessControlException

解决方法

在 hdfs-site.xml 添加参数：

<name>dfs.permissions</name>

<value>false</value>

</property>

</configuration>

4、org.apache.hadoop.hdfs.server.datanode.DataNode: java.io.IOException: Incompatible namespaceIDs in /opt/hadoop-tmp/dfs/data: namenode namespaceID = 1165565627; datanode namespaceID = 1468616188

解决方法：以name为准，将namenode节点上${hadoop-tmp}/hfs/data/current/VERSION文件的namespaceID改为${hadoop-tmp}/hfs/name/current/VERSION文件的namespaceID。同时将datanode节点上的${hadoop-tmp}/hfs/data/current/VERSION文件的namespaceID相应修改

5、org.apache.hadoop.hdfs.server.datanode.DataNode: All directories in dfs.data.dir are invalid

发生错误的原因就是hdfs下的data文件夹权限设置错误，应为rwxr-xr-x，因此修改方式如下：

解决方法：chmod 755 /opt/hadoop-tmp/ –R

6、ERROR security.UserGroupInformation: PriviledgedActionException as:alvin cause:java.net.ConnectException: Call to 192.168.95.134/192.168.95.134:9091 failed on connection exception: java.net.ConnectException: Connection refused

java.net.ConnectException: Call to 192.168.95.134/192.168.95.134:9091 failed on connection exception: java.net.ConnectException: Connection refused

at org.apache.hadoop.ipc.Client.wrapException(Client.java:1142)

解决方法：确认IP和端口号是否正确，mapreduce端口号是9001，这里是9091.所以报错

7、启动hadoop时，log中出现：java.io.IOException: NameNode is not formatted.

解决方法：初始化namenode

./hadoop namenode –format

下面关于Hadoop的文章您也可能喜欢，不妨看看：

font font-size valign hadoop top

安科网

Hadoop 1.2 集群搭建与环境配置

shenhongdb

shenhongdb

相关推荐

Linux解压文件

VS Code + PlantUML实现跨平台设计

让数据处理更简单？百度EasyData推出首个高级智能数据清洗功能

css常用的简写技巧_css background简写、css border 简写、css font属性简写等

数据科学家、开发者的新神器 Amazon SageMaker正式上线中国区

虹软开放平台算法上新助力全面拓展人脸识别细分化场景

代码（移动端rem初始化设置1rem=15px）

十大常见的Linux邮件客户端

2020年机器学习领域的五个潮流

什么是真正的架构设计？十年Java经验让我总结出了这些，不愧是我

使用Eclipse在Fedora上进行 PHP 开发

12个提高JavaScript技能的概念

win10家庭版找不到gpedit.msc的解决办法

jackson gson

总结一些，我在书写 CSS 的时候，经常犯的错误！

如何用Spring WebFlux构建Reactive REST API

雷林鹏分享：Apache POI字体/Fonts

JQuery省市联动效果实现过程详解

Blogs顶部添加欢迎信息

Markdown常用语法

shenhongdb