当前位置: 开发笔记 > 编程语言 > 正文

Hadoop快速入门系列(7)|Hadoop集群HA简介

作者：manassatromble | 来源：互联网 | 2023-10-10 14:05

HA概述1）所谓HA（highavailable），即高可用（7*24小时不中断服务）。2&

HA概述

1&＃xff09;所谓HA&＃xff08;high available&＃xff09;&＃xff0c;即高可用&＃xff08;7*24小时不中断服务&＃xff09;。

2&＃xff09;实现高可用最关键的策略是消除单点故障。HA严格来说应该分成各个组件的HA机制&＃xff1a;HDFS的HA和YARN的HA。

3&＃xff09;Hadoop2.0之前&＃xff0c;在HDFS集群中NameNode存在单点故障&＃xff08;SPOF&＃xff09;。

4&＃xff09;NameNode主要在以下两个方面影响HDFS集群

NameNode机器发生意外&＃xff0c;如宕机&＃xff0c;集群将无法使用&＃xff0c;直到管理员重启

NameNode机器需要升级&＃xff0c;包括软件、硬件升级&＃xff0c;此时集群也将无法使用

HDFS HA功能通过配置Active/Standby两个nameNodes实现在集群中对NameNode的热备来解决上述问题。如果出现故障&＃xff0c;如机器崩溃或机器需要升级维护&＃xff0c;这时可通过此种方式将NameNode很快的切换到另外一台机器。

HDFS-HA工作机制

1&＃xff09;通过双namenode消除单点故障

HDFS-HA工作要点

1&＃xff09;元数据管理方式需要改变&＃xff1a;

内存中各自保存一份元数据&＃xff1b;

Edits日志只有Active状态的namenode节点可以做写操作&＃xff1b;

两个namenode都可以读取edits&＃xff1b;

共享的edits放在一个共享存储中管理&＃xff08;qjournal和NFS两个主流实现&＃xff09;&＃xff1b;

2&＃xff09;需要一个状态管理功能模块

实现了一个zkfailover&＃xff0c;常驻在每一个namenode所在的节点&＃xff0c;每一个zkfailover负责监控自己所在namenode节点&＃xff0c;利用zk进行状态标识&＃xff0c;当需要进行状态切换时&＃xff0c;由zkfailover来负责切换&＃xff0c;切换时需要防止brain split现象的发生。

3&＃xff09;必须保证两个NameNode之间能够ssh无密码登录。

4&＃xff09;隔离&＃xff08;Fence&＃xff09;&＃xff0c;即同一时刻仅仅有一个NameNode对外提供服务

HDFS-HA自动故障转移工作机制

前面学习了使用命令hdfs haadmin -failover手动进行故障转移&＃xff0c;在该模式下&＃xff0c;即使现役NameNode已经失效&＃xff0c;系统也不会自动从现役NameNode转移到待机NameNode&＃xff0c;下面学习如何配置部署HA自动进行故障转移。自动故障转移为HDFS部署增加了两个新组件&＃xff1a;ZooKeeper和ZKFailoverController&＃xff08;ZKFC&＃xff09;进程。ZooKeeper是维护少量协调数据&＃xff0c;通知客户端这些数据的改变和监视客户端故障的高可用服务。HA的自动故障转移依赖于ZooKeeper的以下功能&＃xff1a;

1&＃xff09;故障检测&＃xff1a;集群中的每个NameNode在ZooKeeper中维护了一个持久会话&＃xff0c;如果机器崩溃&＃xff0c;ZooKeeper中的会话将终止&＃xff0c;ZooKeeper通知另一个NameNode需要触发故障转移。

2&＃xff09;现役NameNode选择&＃xff1a;ZooKeeper提供了一个简单的机制用于唯一的选择一个节点为active状态。如果目前现役NameNode崩溃&＃xff0c;另一个节点可能从ZooKeeper获得特殊的排外锁以表明它应该成为现役NameNode。

ZKFC是自动故障转移中的另一个新组件&＃xff0c;是ZooKeeper的客户端&＃xff0c;也监视和管理NameNode的状态。每个运行NameNode的主机也运行了一个ZKFC进程&＃xff0c;ZKFC负责&＃xff1a;

1&＃xff09;健康监测&＃xff1a;ZKFC使用一个健康检查命令定期地ping与之在相同主机的NameNode&＃xff0c;只要该NameNode及时地回复健康状态&＃xff0c;ZKFC认为该节点是健康的。如果该节点崩溃&＃xff0c;冻结或进入不健康状态&＃xff0c;健康监测器标识该节点为非健康的。

2&＃xff09;ZooKeeper会话管理&＃xff1a;当本地NameNode是健康的&＃xff0c;ZKFC保持一个在ZooKeeper中打开的会话。如果本地NameNode处于active状态&＃xff0c;ZKFC也保持一个特殊的znode锁&＃xff0c;该锁使用了ZooKeeper对短暂节点的支持&＃xff0c;如果会话终止&＃xff0c;锁节点将自动删除。

3&＃xff09;基于ZooKeeper的选择&＃xff1a;如果本地NameNode是健康的&＃xff0c;且ZKFC发现没有其它的节点当前持有znode锁&＃xff0c;它将为自己获取该锁。如果成功&＃xff0c;则它已经赢得了选择&＃xff0c;并负责运行故障转移进程以使它的本地NameNode为active。故障转移进程与前面描述的手动故障转移相似&＃xff0c;首先如果必要保护之前的现役NameNode&＃xff0c;然后本地NameNode转换为active状态。

推荐阅读

install
Hadoop （CDH4发行版）集群部署（部署脚本，namenode高可用，hadoop管理）

前言折腾了一段时间hadoop的部署管理，写下此系列博客记录一下。为了避免各位做部署这种重复性的劳动，我已经把部署的步骤写成脚本，各位只需要按着本文把脚本执行完，整个环境基本就部署 ... [详细]

蜡笔小新 2023-10-16 15:11:51
config
HDFS2.x新特性

一、集群间数据拷贝scp实现两个远程主机之间的文件复制scp-rhello.txtroothadoop103:useratguiguhello.txt推pushscp-rr ... [详细]

蜡笔小新 2023-12-13 13:52:40
config
windows部署hadoop2.7.0

这里使用自己编译的hadoop-2.7.0版本部署在windows上，记得几年前，部署hadoop需要借助于cygwin，还需要开启ssh服务，最近发现，原来不需要借助cy ... [详细]

蜡笔小新 2023-10-17 21:04:04
config
Hadoop2.6.0 + 云centos +伪分布式只谈部署

3.0.3玩不好，现将2.6.0tar.gz上传到usr,chmod-Rhadoop:hadophadoop-2.6.0，rm掉3.0.32.在etcp ... [详细]

蜡笔小新 2023-10-17 19:28:24
config
Kylin 单节点安装

软件环境Hadoop:2.7,3.1(sincev2.5)Hive:0.13-1.2.1HBase:1.1,2.0(sincev2.5)Spark(optional)2.3.0K ... [详细]

蜡笔小新 2023-10-16 16:09:42
config
Hadoop与大数据技术大会将于11月30日开幕

11月26日，由中国计算机协会（CCF）主办，CCF大数据专家委员会协办，CSDN承办的Hadoop与大数据技术大会（Hadoop&BigDataTechnology ... [详细]

蜡笔小新 2023-10-17 17:47:11
config
什么是大数据lambda架构

一、什么是Lambda架构Lambda架构由Storm的作者[NathanMarz]提出，根据维基百科的定义，Lambda架构的设计是为了在处理大规模数 ... [详细]

蜡笔小新 2023-10-17 16:06:09
config
Hadoop源码解析1Hadoop工程包架构解析

1 Hadoop中各工程包依赖简述 Google的核心竞争技术是它的计算平台。Google的大牛们用了下面5篇文章，介绍了它们的计算设施。 GoogleCluster：ht ... [详细]

蜡笔小新 2023-10-17 13:28:20
config
mapreduce源码分析总结

这篇文章总结的非常到位,故而转之一MapReduce概述MapReduce是一个用于大规模数据处理的分布式计算模型，它最初是由Google工程师设计并实现的ÿ ... [详细]

蜡笔小新 2023-10-17 12:36:35
config
MR程序的几种提交运行模式

MR程序的几种提交运行模式本地模型运行1在windows的eclipse里面直接运行main方法，就会将job提交给本地执行器localjobrunner执行-- ... [详细]

蜡笔小新 2023-10-16 18:29:26
config
Hadoop学习笔记1：伪分布式环境搭建

在搭建Hadoop环境之前，请先阅读如下博文，把搭建Hadoop环境之前的准备工作做好，博文如下： 1、CentOS6.7下安装JDK,地址：http:b ... [详细]

蜡笔小新 2023-10-16 16:04:04
config
hadoop基础----hadoop实战(六)-----hadoop管理工具---Cloudera Manager---CDH介绍

我们在之前的文章中已经初步介绍了Cloudera。hadoop基础----hadoop实战(零)-----hadoop的平台版本选择从版本选择这篇文章中我们了解到除了hadoop官方版本外很多 ... [详细]

蜡笔小新 2023-10-16 14:21:13
config
MapReduce工作流程最详细解释

MapReduce是我们再进行离线大数据处理的时候经常要使用的计算模型，MapReduce的计算过程被封装的很好，我们只用使用Map和Reduce函数，所以对其整体的计算过程不是太 ... [详细]

蜡笔小新 2023-10-16 14:14:27
shell
Azkaban（三）Azkaban的使用

界面介绍首页有四个菜单projects：最重要的部分，创建一个工程，所有flows将在工程中运行。scheduling:显示定时任务executing:显示当前运行的任务histo ... [详细]

蜡笔小新 2023-10-15 23:43:11
shell
Java开发实战讲解！字节跳动三场技术面+HR面

二、回顾整理阿里面试题基本就这样了，还有一些零星的问题想不起来了，答案也整理出来了。自我介绍JVM如何加载一个类的过程，双亲委派模型中有 ... [详细]

蜡笔小新 2023-10-15 19:48:25

manassatromble

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章