通常是指2台机器启动着彻底相同的业务系统,当有一台机器down机了,另一台服务器就能快速的接管,对于访问的用户是无感知的。nginx
硬件使用F5web
软件使用keepalivedvim
keepalived软件是基于VRRP协议实现的,VRRP虚拟路由冗余协议,主要用于解决单点故障问题windows
好比公司的网络是经过网关进行上网的,那么若是该路由器故障了,网关没法转发报文了,此时全部人都没法上网了,怎么办?缓存
一般作法是给路由器增长一台北街店,可是问题是,若是咱们的主网关master故障了,用户是须要手动指向backup的,若是用户过多修改起来会很是麻烦。服务器
问题一:假设用户将指向都修改成backup路由器,那么master路由器修好了怎么办?
问题二:假设Master网关故障,咱们将backup网关配置为master网关的ip是否能够?网络
实际上是不行的,由于PC第一次经过ARP广播寻找到Master网关的MAC地址与IP地址后,会将信息写到ARP的缓存表中,那么PC以后链接都是经过那个缓存表的信息去链接,而后进行数据包的转发,即便咱们修改了IP可是Mac地址是惟一的,pc的数据包依然会发送给master。(除非是PC的ARP缓存表过时,再次发起ARP广播的时候才能获取新的backup对应的Mac地址与IP地址)测试
如何才能作到出现故障自动转移,此时VRRP就出现了,咱们的VRRP实际上是经过软件或者硬件的形式在Master和Backup外面增长一个虚拟的MAC地址(VMAC)与虚拟IP地址(VIP),那么在这种状况下,PC请求VIP的时候,不管是Master处理仍是Backup处理,PC仅会在ARP缓存表中记录VMAC与VIP的信息。code
一般业务系统须要保证7×24小时不DOWN机,好比公司内部的OA系统,天天公司人员都须要使用,则不容许Down机,做为业务系统来讲随时均可用router
一、如何肯定谁是主节点谁是背节点(选举投票,优先级)
二、若是Master故障,Backup自动接管,那么Master回复后会夺权吗(抢占试、非抢占式)
三、若是两台服务器都认为本身是Master会出现什么问题(脑裂)
做用 | IP | 角色 |
---|---|---|
节点1 | 10.0.0.5 | Master |
节点2 | 10.0.0.6 | Backup |
VIP | 10.0.0.3 |
[root@lb01 ~]# yum install -y keepalived [root@lb02 ~]# yum install -y keepalived
#找到配置文件 [root@lb02 ~]# rpm -qc keepalived /etc/keepalived/keepalived.conf /etc/sysconfig/keepalived #编辑配置文件 [root@lb01 ~]# cat /etc/keepalived/keepalived.conf global_defs { #全局配置 router_id lb01 #标识身份->名称 } vrrp_instance VI_1 { state MASTER #标识角色状态 interface eth0 #网卡绑定接口 virtual_router_id 50 #虚拟路由id priority 150 #优先级 advert_int 1 #监测间隔时间 authentication { #认证 auth_type PASS #认证方式 auth_pass 1111 #认证密码 } virtual_ipaddress { 10.0.0.3 #虚拟的VIP地址 } }
[root@lb02 ~]# cat /etc/keepalived/keepalived.conf global_defs { router_id lb02 } vrrp_instance VI_1 { state BACKUP interface eth0 virtual_router_id 50 priority 100 advert_int 1 authentication { auth_type PASS auth_pass 1111 } virtual_ipaddress { 10.0.0.3 } }
Keepalived配置区别 | Master节点配置 | Backup节点配置 |
---|---|---|
route_id(惟一标识) | router_id lb01 | router_id lb02 |
state(角色状态) | state MASTER | state BACKUP |
priority(竞选优先级) | priority 150 | priority 100 |
#Master节点 [root@lb01 ~]# systemctl start keepalived [root@lb01 ~]# systemctl enable keepalived #Backup节点 [root@lb02 ~]# systemctl start keepalived [root@lb02 ~]# systemctl enable keepalived
#因为节点1的优先级高于节点2,因此VIP在节点1上面 [root@lb01 ~]# ip addr | grep 10.0.0.3 inet 10.0.0.3/32 scope global eth0
[root@lb01 ~]# systemctl stop keepalived #节点2联系不上节点1,主动接管VIP [root@lb02 ~]# ip addr | grep 10.0.0.3 inet 10.0.0.3/32 scope global eth0
[root@lb01 ~]# systemctl start keepalived [root@lb01 ~]# ip addr | grep 10.0.0.3 inet 10.0.0.3/32 scope global eth0
一、两个节点的state都必须配置为BACKUP 二、两个节点都必须加上配置 nopreempt 三、其中一个节点的优先级必需要高于另一个节点的优先级。 两台服务器都角色状态启用nopreempt后,必须修改角色状态统一为BACKUP,惟一的区分就是优先级。 Master配置 vrrp_instance VI_1 { state BACKUP priority 150 nopreempt } Backup配置 vrrp_instance VI_1 { state BACKUP priority 100 nopreempt }
#查看VIP在节点1上面 [root@lb01 ~]# ip addr | grep 10.0.0.3 inet 10.0.0.3/32 scope global eth0 #windows查看Mac地址
#将节点1的keepalived停掉 [root@lb01 ~]# systemctl stop keepalived #节点2接管VIP [root@lb02 ~]# ip addr | grep 10.0.0.3 inet 10.0.0.3/32 scope global eth0 #再次查看mac地址 arp -a
因为某些缘由,致使两台keepalived高可用服务器在指定时间内,没法检测到对方的心跳,个字去的资源及服务的全部权,而此时的两台高可用服务器又都还活着。
一、服务器网线松动等网络故障
二、服务器硬件故障发生损坏现象而崩溃
三、主备都开启firewalld防火墙
#将节点1和节点2的防火墙都打开 [root@lb01 ~]# systemctl start firewalld [root@lb02 ~]# systemctl start firewalld #fireshark抓包查看
#若是发生闹裂,则随机kill掉一台便可 #在备上编写检测脚本, 测试若是能ping通主而且备节点还有VIP的话则认为产生了列脑 [root@lb02 ~]# cat check_split_brain.sh #!/bin/sh vip=10.0.0.3 lb01_ip=10.0.0.5 while true;do ping -c 2 $lb01_ip &>/dev/null if [ $? -eq 0 -a `ip add|grep "$vip"|wc -l` -eq 1 ];then echo "ha is split brain.warning." else echo "ha is ok" fi sleep 5 done
Nginx默认监听在全部的IP地址上,VIP会飘到一台节点上,至关于那台nginx多了VIP这么一个网卡,因此能够访问到nginx所在机器
[root@lb01 ~]# mkdir /server/scripts [root@lb01 ~]# vim /server/scripts/check_web.sh #!/bin/sh nginxpid=$(ps -C nginx --no-header|wc -l) #1.判断Nginx是否存活,若是不存活则尝试启动Nginx if [ $nginxpid -eq 0 ];then systemctl start nginx sleep 3 #2.等待3秒后再次获取一次Nginx状态 nginxpid=$(ps -C nginx --no-header|wc -l) #3.再次进行判断, 如Nginx还不存活则中止Keepalived,让地址进行漂移,并退出脚本 if [ $nginxpid -eq 0 ];then systemctl stop keepalived fi fi #给脚本增长执行权限 [root@lb01 ~]# chmod +x /server/scripts/check_web.sh
[root@lb01 ~]# cat /etc/keepalived/keepalived.conf global_defs { router_id lb01 } #每5秒执行一次脚本,脚本执行内容不能超过5秒,不然会中断再次从新执行脚本 vrrp_script check_web { script "/server/scripts/check_web.sh" interval 5 } vrrp_instance VI_1 { state MASTER interface eth0 virtual_router_id 50 priority 150 advert_int 1 authentication { auth_type PASS auth_pass 1111 } virtual_ipaddress { 10.0.0.3 } #调用并运行脚本 track_script { check_web } } #在Master的keepalived中调用脚本,抢占式,仅需在master配置便可。(注意,若是配置为非抢占式,那么须要两台服务器都使用该脚本)