HA集羣搭建

時間 2019-11-16

標籤集羣搭建欄目負載均衡简体版

原文原文鏈接

hadoop2.0已經發布了穩定版本了，增長了不少特性，好比HDFS HA、YARN等。最新的hadoop-2.6.4又增長了YARN HAjava

注意：apache提供的hadoop-2.6.4的安裝包是在32位操做系統編譯的，由於hadoop依賴一些C++的本地庫，
因此若是在64位的操做上安裝hadoop-2.6.4就須要從新在64操做系統上從新編譯
（建議第一次安裝用32位的系統，我將編譯好的64位的也上傳到羣共享裏了，若是有興趣的能夠本身編譯一下）node

前期準備就不詳細說了，課堂上都介紹了
1.修改Linux主機名
2.修改IP
3.修改主機名和IP的映射關係 /etc/hosts
######注意######若是大家公司是租用的服務器或是使用的雲主機（如華爲用主機、阿里雲主機等）
/etc/hosts裏面要配置的是內網IP地址和主機名的映射關係
4.關閉防火牆
5.ssh免登錄
6.安裝JDK，配置環境變量等shell

集羣規劃：
主機名 IP 安裝的軟件運行的進程
hadoop00 192.168.1.200 jdk、hadoop NameNode、DFSZKFailoverController(zkfc)
hadoop01 192.168.1.201 jdk、hadoop NameNode、DFSZKFailoverController(zkfc)
hadoop02 192.168.1.202 jdk、hadoop ResourceManager
hadoop03 192.168.1.203 jdk、hadoop ResourceManager
hadoop04 192.168.1.204 jdk、hadoop DataNode、NodeManager
hadoop05 192.168.1.205 jdk、hadoop、zookeeper DataNode、NodeManager、JournalNode、QuorumPeerMain
hadoop06 192.168.1.206 jdk、hadoop、zookeeper DataNode、NodeManager、JournalNode、QuorumPeerMain
hadoop07 192.168.1.207 jdk、hadoop、zookeeper DataNode、NodeManager、JournalNode、QuorumPeerMain

說明：
1.在hadoop2.0中一般由兩個NameNode組成，一個處於active狀態，另外一個處於standby狀態。Active NameNode對外提供服務，而Standby NameNode則不對外提供服務，僅同步active namenode的狀態，以便可以在它失敗時快速進行切換。
hadoop2.0官方提供了兩種HDFS HA的解決方案，一種是NFS，另外一種是QJM。這裏咱們使用簡單的QJM。在該方案中，主備NameNode之間經過一組JournalNode同步元數據信息，一條數據只要成功寫入多數JournalNode即認爲寫入成功。一般配置奇數個JournalNode
這裏還配置了一個zookeeper集羣，用於ZKFC（DFSZKFailoverController）故障轉移，當Active NameNode掛掉了，會自動切換Standby NameNode爲standby狀態
2.hadoop-2.2.0中依然存在一個問題，就是ResourceManager只有一個，存在單點故障，hadoop-2.6.4解決了這個問題，有兩個ResourceManager，一個是Active，一個是Standby，狀態由zookeeper進行協調
安裝步驟：
1.安裝配置zooekeeper集羣（在hadoop05上）
1.1解壓
tar -zxvf zookeeper-3.4.5.tar.gz -C /home/hadoop/app/
1.2修改配置
cd /home/hadoop/app/zookeeper-3.4.5/conf/
cp zoo_sample.cfg zoo.cfg
vim zoo.cfg
修改：dataDir=/home/hadoop/app/zookeeper-3.4.5/tmp
在最後添加：
server.1=hadoop05:2888:3888
server.2=hadoop06:2888:3888
server.3=hadoop07:2888:3888
保存退出
而後建立一個tmp文件夾
mkdir /home/hadoop/app/zookeeper-3.4.5/tmp
echo 1 > /home/hadoop/app/zookeeper-3.4.5/tmp/myid
1.3將配置好的zookeeper拷貝到其餘節點(首先分別在hadoop0六、hadoop07根目錄下建立一個hadoop目錄：mkdir /hadoop)
scp -r /home/hadoop/app/zookeeper-3.4.5/ hadoop06:/home/hadoop/app/
scp -r /home/hadoop/app/zookeeper-3.4.5/ hadoop07:/home/hadoop/app/

注意：修改hadoop0六、hadoop07對應/hadoop/zookeeper-3.4.5/tmp/myid內容
hadoop06：
echo 2 > /home/hadoop/app/zookeeper-3.4.5/tmp/myid
hadoop07：
echo 3 > /home/hadoop/app/zookeeper-3.4.5/tmp/myid

2.安裝配置hadoop集羣（在hadoop00上操做）
2.1解壓
tar -zxvf hadoop-2.6.4.tar.gz -C /home/hadoop/app/
2.2配置HDFS（hadoop2.0全部的配置文件都在$HADOOP_HOME/etc/hadoop目錄下）
#將hadoop添加到環境變量中
vim /etc/profile
export JAVA_HOME=/usr/java/jdk1.7.0_55
export HADOOP_HOME=/hadoop/hadoop-2.6.4
export PATH=$PATH:$JAVA_HOME/bin:$HADOOP_HOME/bin

#hadoop2.0的配置文件所有在$HADOOP_HOME/etc/hadoop下
cd /home/hadoop/app/hadoop-2.6.4/etc/hadoop

2.2.1修改hadoo-env.sh
export JAVA_HOME=/home/hadoop/app/jdk1.7.0_55apache

###############################################################################

2.2.2修改core-site.xml
<configuration>

<property>
<name>fs.defaultFS</name>
<value>hdfs://hdp24/</value>
</property>

<property>
<name>hadoop.tmp.dir</name>
<value>/root/hdptmp/</value>
</property>bootstrap

<property>
<name>ha.zookeeper.quorum</name>
<value>hdp-05:2181,hdp-06:2181,hdp-07:2181</value>
</property>
</configuration>vim

###############################################################################

2.2.3修改hdfs-site.xml
<configuration>

<property>
<name>dfs.nameservices</name>
<value>hdp24</value>
</property>

<property>
<name>dfs.ha.namenodes.hdp24</name>
<value>nn1,nn2</value>
</property>

<property>
<name>dfs.namenode.rpc-address.hdp24.nn1</name>
<value>hdp-01:9000</value>
</property>

<property>
<name>dfs.namenode.http-address.hdp24.nn1</name>
<value>hdp-01:50070</value>
</property>

<property>
<name>dfs.namenode.rpc-address.hdp24.nn2</name>
<value>hdp-02:9000</value>
</property>

<property>
<name>dfs.namenode.http-address.hdp24.nn2</name>
<value>hdp-02:50070</value>
</property>瀏覽器

<property>
<name>dfs.namenode.name.dir</name>
<value>/root/hdpdata/name</value>
</property>服務器

<property>
<name>dfs.datanode.data.dir</name>
<value>/root/hdpdata/data</value>
</property>app

<property>
<name>dfs.namenode.shared.edits.dir</name>
<value>qjournal://hdp-05:8485;hdp-06:8485;hdp-07:8485/hdp24</value>
</property>框架

<property>
<name>dfs.journalnode.edits.dir</name>
<value>/root/hdpdata/journaldata</value>
</property>

<property>
<name>dfs.ha.automatic-failover.enabled</name>
<value>true</value>
</property>

<property>
<name>dfs.client.failover.proxy.provider.hdp24</name>
<value>org.apache.hadoop.hdfs.server.namenode.ha.ConfiguredFailoverProxyProvider</value>
</property>

<property>
<name>dfs.ha.fencing.methods</name>
<value>
sshfence
shell(/bin/true)
</value>
</property>

<property>
<name>dfs.ha.fencing.ssh.private-key-files</name>
<value>/root/.ssh/id_rsa</value>
</property>

<property>
<name>dfs.ha.fencing.ssh.connect-timeout</name>
<value>30000</value>
</property>
</configuration>

###############################################################################

2.2.4修改mapred-site.xml
<configuration>

<property>
<name>mapreduce.framework.name</name>
<value>yarn</value>
</property>
</configuration>

###############################################################################

2.2.5修改yarn-site.xml
<configuration>

<property>
<name>yarn.resourcemanager.ha.enabled</name>
<value>true</value>
</property>

<property>
<name>yarn.resourcemanager.cluster-id</name>
<value>yrc</value>
</property>

<property>
<name>yarn.resourcemanager.ha.rm-ids</name>
<value>rm1,rm2</value>
</property>

<property>
<name>yarn.resourcemanager.hostname.rm1</name>
<value>hdp-03</value>
</property>
<property>
<name>yarn.resourcemanager.hostname.rm2</name>
<value>hdp-04</value>
</property>

<property>
<name>yarn.resourcemanager.zk-address</name>
<value>hdp-01:2181,hdp-02:2181,hdp-03:2181</value>
</property>
<property>
<name>yarn.nodemanager.aux-services</name>
<value>mapreduce_shuffle</value>
</property>
</configuration>

2.2.6修改slaves(slaves是指定子節點的位置，由於要在hadoop01上啓動HDFS、在hadoop03啓動yarn，因此hadoop01上的slaves文件指定的是datanode的位置，hadoop03上的slaves文件指定的是nodemanager的位置)
hadoop05
hadoop06
hadoop07

2.2.7配置免密碼登錄
#首先要配置hadoop00到hadoop0一、hadoop0二、hadoop0三、hadoop0四、hadoop0五、hadoop0六、hadoop07的免密碼登錄
#在hadoop01上生產一對鑰匙
ssh-keygen -t rsa
#將公鑰拷貝到其餘節點，包括本身
ssh-coyp-id hadoop00
ssh-coyp-id hadoop01
ssh-coyp-id hadoop02
ssh-coyp-id hadoop03
ssh-coyp-id hadoop04
ssh-coyp-id hadoop05
ssh-coyp-id hadoop06
ssh-coyp-id hadoop07
#配置hadoop02到hadoop0四、hadoop0五、hadoop0六、hadoop07的免密碼登錄
#在hadoop02上生產一對鑰匙
ssh-keygen -t rsa
#將公鑰拷貝到其餘節點
ssh-coyp-id hadoop03
ssh-coyp-id hadoop04
ssh-coyp-id hadoop05
ssh-coyp-id hadoop06
ssh-coyp-id hadoop07
#注意：兩個namenode之間要配置ssh免密碼登錄，別忘了配置hadoop01到hadoop00的免登錄
在hadoop01上生產一對鑰匙
ssh-keygen -t rsa
ssh-coyp-id -i hadoop00

2.4將配置好的hadoop拷貝到其餘節點
scp -r /hadoop/ hadoop02:/
scp -r /hadoop/ hadoop03:/
scp -r /hadoop/hadoop-2.6.4/ hadoop@hadoop04:/hadoop/
scp -r /hadoop/hadoop-2.6.4/ hadoop@hadoop05:/hadoop/
scp -r /hadoop/hadoop-2.6.4/ hadoop@hadoop06:/hadoop/
scp -r /hadoop/hadoop-2.6.4/ hadoop@hadoop07:/hadoop/

###注意：嚴格按照下面的步驟!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!
2.5啓動zookeeper集羣（分別在hdp-0五、hdp-0六、hdp-07上啓動zk）
cd /hadoop/zookeeper-3.4.5/bin/
./zkServer.sh start
#查看狀態：一個leader，兩個follower
./zkServer.sh status

2.6手動啓動journalnode（分別在在hdp-0五、hdp-0六、hdp-07上執行）
cd /hadoop/hadoop-2.6.4
sbin/hadoop-daemon.sh start journalnode
#運行jps命令檢驗，hadoop0五、hadoop0六、hadoop07上多了JournalNode進程

2.7格式化namenode
#在hdp-01上執行命令:
hdfs namenode -format
#格式化後會在根據core-site.xml中的hadoop.tmp.dir配置生成個文件，這裏我配置的是/hadoop/hadoop-2.6.4/tmp，而後將/hadoop/hadoop-2.6.4/tmp拷貝到hadoop02的/hadoop/hadoop-2.6.4/下。
scp -r tmp/ hadoop02:/home/hadoop/app/hadoop-2.6.4/
##也能夠這樣，建議hdfs namenode -bootstrapStandby

2.8格式化ZKFC(在hdp-01上執行便可)
hdfs zkfc -formatZK

2.9啓動HDFS(在hadoop00上執行)
sbin/start-dfs.sh

2.10啓動YARN(#####注意#####：是在hadoop02上執行start-yarn.sh，把namenode和resourcemanager分開是由於性能問題，由於他們都要佔用大量資源，因此把他們分開了，他們分開了就要分別在不一樣的機器上啓動)
sbin/start-yarn.sh

到此，hadoop-2.6.4配置完畢，能夠統計瀏覽器訪問:
http://hadoop00:50070
NameNode 'hadoop01:9000' (active)
http://hadoop01:50070
NameNode 'hadoop02:9000' (standby)

驗證HDFS HA
首先向hdfs上傳一個文件
hadoop fs -put /etc/profile /profile
hadoop fs -ls /
而後再kill掉active的NameNode
kill -9 <pid of NN>
經過瀏覽器訪問：http://192.168.1.202:50070
NameNode 'hadoop02:9000' (active)
這個時候hadoop02上的NameNode變成了active
在執行命令：
hadoop fs -ls /
-rw-r--r-- 3 root supergroup 1926 2014-02-06 15:36 /profile
剛纔上傳的文件依然存在！！！
手動啓動那個掛掉的NameNode
sbin/hadoop-daemon.sh start namenode
經過瀏覽器訪問：http://192.168.1.201:50070
NameNode 'hadoop01:9000' (standby)

驗證YARN：
運行一下hadoop提供的demo中的WordCount程序：
hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-2.4.1.jar wordcount /profile /out

OK，大功告成！！！

測試集羣工做狀態的一些指令：
bin/hdfs dfsadmin -report 查看hdfs的各節點狀態信息

bin/hdfs haadmin -getServiceState nn1 獲取一個namenode節點的HA狀態

sbin/hadoop-daemon.sh start namenode 單獨啓動一個namenode進程

./hadoop-daemon.sh start zkfc 單獨啓動一個zkfc進程

相關文章

相關標籤/搜索

Windows集羣環境搭建

網站建設指南

每日一句

每一个你不满意的现在，都有一个你没有努力的曾经。

最新文章

本站公眾號

歡迎關注本站公眾號,獲取更多信息

相關文章

>>更多相關文章<<