Hadoop-HA集群搭建
一、基础准备工作
1、准备好5台Linux系统虚拟服务器或物理服务器
我这里演示采用虚拟服务器搭建Hadoop-HA集群,各自功能分配如下:
NameNode节点:vt-serv、vt-serv4
DataNode节点:vt-serv1、vt-serv2、vt-serv3
Journalnode节点:vt-serv1、vt-serv2、vt-serv3
Zookeeper服务器:vt-serv1、vt-serv2、vt-serv3
mysql数据库:vt-serv
Hive数据仓库:vt-serv4
注:这5台服务器已经配置好了JDK1.8、Zookeeper、mysql-5.6等必备工具及基本环境,这些基础配置以及Hive在这里不作介绍!
2、在每台服务器上创建共同的账号:hadoop ;以及工作组:bigdata
|
1 2 |
|
|
1 2 |
|
3、配置hadoop账户在服务器之间进行免密登录
① 在各服务器上生成密钥
|
1 2 |
|
② 将每一台服务器生成的密钥整合到同一台服务器(每一台服务器上执行)
|
1 2 |
|
③ 将整合成功的密钥分发到其它几台服务器
|
1 2 3 4 5 |
|
④ 修改authorized_keys权限(只允许自己可以读写,权限过大系统会拒绝远程登录;同样每一台服务器都执行)
|
1 2 |
|
⑤ 测试远程登录(任意服务器之间进行登录操作验证,如果能直接登录到对方服务器就表示配置OK!)
|
1 2 |
|
二、HA高可用集群搭建
1、准备好hadoop安装包
我这是用的是hadoop-2.7.6.tar.gz 官网提供
2、创建hadoop工作目录
|
1 2 3 |
|
3、解压安装包
|
1 2 |
|
4、配置core-site.xml文件
|
1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 |
|
5、配置hdfs-site.xml文件
|
1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 |
|
6、编辑slaves 加入数据节点服务器名
|
1 2 3 4 5 6 |
|
7、将配置好的hadoop分发到各台服务器相同目录
|
1 2 |
|
8、启动JournalNode(我的JournalNode配置的分别是vt-serv1 、vt-serv2、vt-serv3三台服务器,分别去启动)
|
1 |
|
9、在nn1格式化namenode
|
1 2 |
|
10、在nn1启动namenode
|
1 |
|
11、在nn2同步namenode
|
1 |
|
12、格式zookeeper zkfc数据(需要先保证Zookeeper是正常启动)
|
1 |
|
13、启动HDFS HA集群(在哪台namenode启动,则作为active)
|
1 |
|
14、验证(停止 actived 那台服务器的 namenode)
|
1 |
|
正常情况下集群会把另一台namenode的standby状态自动切换为active状态 至此Hadoop-HA高可用集群配置完毕!
15、配置本地虚拟域名(路径:C:\Windows\System32\drivers\etc\hosts)加入自己的虚拟域名
|
1 2 3 |
|
更多推荐





所有评论(0)