nginx——keepalived

时间 2019-11-29

标签 nginx keepalived 栏目 Nginx 繁體版

原文原文链接

nginx——keepalived

1.keepalived高可用基本概述

什么是高可用

通常是指2台机器启动着彻底相同的业务系统，当有一台机器down机了，另一台服务器就能快速的接管，对于访问的用户是无感知的。nginx

高可用一般使用什么软件

硬件使用F5web

软件使用keepalivedvim

keepalilved是如何实现高可用的

keepalived软件是基于VRRP协议实现的，VRRP虚拟路由冗余协议，主要用于解决单点故障问题windows

那么vrrp是如何诞生的，原理又是什么？

好比公司的网络是经过网关进行上网的，那么若是该路由器故障了，网关没法转发报文了，此时全部人都没法上网了，怎么办？缓存

一般作法是给路由器增长一台北街店，可是问题是，若是咱们的主网关master故障了，用户是须要手动指向backup的，若是用户过多修改起来会很是麻烦。服务器

问题一：假设用户将指向都修改成backup路由器，那么master路由器修好了怎么办？
问题二：假设Master网关故障，咱们将backup网关配置为master网关的ip是否能够？网络

实际上是不行的，由于PC第一次经过ARP广播寻找到Master网关的MAC地址与IP地址后，会将信息写到ARP的缓存表中，那么PC以后链接都是经过那个缓存表的信息去链接，而后进行数据包的转发，即便咱们修改了IP可是Mac地址是惟一的，pc的数据包依然会发送给master。（除非是PC的ARP缓存表过时，再次发起ARP广播的时候才能获取新的backup对应的Mac地址与IP地址）测试

如何才能作到出现故障自动转移，此时VRRP就出现了，咱们的VRRP实际上是经过软件或者硬件的形式在Master和Backup外面增长一个虚拟的MAC地址（VMAC）与虚拟IP地址（VIP），那么在这种状况下，PC请求VIP的时候，不管是Master处理仍是Backup处理，PC仅会在ARP缓存表中记录VMAC与VIP的信息。code

高可用keepalived使用场景

一般业务系统须要保证7×24小时不DOWN机，好比公司内部的OA系统，天天公司人员都须要使用，则不容许Down机，做为业务系统来讲随时均可用router

一、如何肯定谁是主节点谁是背节点（选举投票，优先级）

二、若是Master故障，Backup自动接管，那么Master回复后会夺权吗（抢占试、非抢占式）

三、若是两台服务器都认为本身是Master会出现什么问题（脑裂）

keepalived高可用安装配置

2.1 实践环境配置

做用	IP	角色
节点1	10.0.0.5	Master
节点2	10.0.0.6	Backup
VIP	10.0.0.3

2.2 在master和backup上分别安装keepalived

[root@lb01 ~]# yum install -y keepalived
[root@lb02 ~]# yum install -y keepalived

2.3 配置节点1，Master

#找到配置文件
[root@lb02 ~]# rpm -qc keepalived
/etc/keepalived/keepalived.conf
/etc/sysconfig/keepalived

#编辑配置文件
[root@lb01 ~]# cat /etc/keepalived/keepalived.conf
global_defs {                   #全局配置
    router_id lb01              #标识身份->名称
}

vrrp_instance VI_1 {
    state MASTER                #标识角色状态
    interface eth0              #网卡绑定接口
    virtual_router_id 50        #虚拟路由id
    priority 150                #优先级
    advert_int 1                #监测间隔时间
    authentication {            #认证
        auth_type PASS          #认证方式
        auth_pass 1111          #认证密码
    }
    virtual_ipaddress {         
        10.0.0.3                #虚拟的VIP地址
    }
}

2.4 配置节点2，Backup

[root@lb02 ~]# cat /etc/keepalived/keepalived.conf
global_defs {
    router_id lb02
}

vrrp_instance VI_1 {
    state BACKUP        
    interface eth0
    virtual_router_id 50
    priority 100
    advert_int 1
    authentication {    
        auth_type PASS
        auth_pass 1111
    }
    virtual_ipaddress {
        10.0.0.3
    }
}

2.5 对比master与Backup的keepalived配置区别

Keepalived配置区别	Master节点配置	Backup节点配置
route_id（惟一标识）	router_id lb01	router_id lb02
state（角色状态）	state MASTER	state BACKUP
priority(竞选优先级)	priority 150	priority 100

2.6 启动Master和Backup节点的keepalived

#Master节点
[root@lb01 ~]# systemctl start keepalived
[root@lb01 ~]# systemctl enable keepalived

#Backup节点
[root@lb02 ~]# systemctl start keepalived
[root@lb02 ~]# systemctl enable keepalived

3. 高可用keepalived抢占式与非抢占式

3.1 两个节点都启动时

#因为节点1的优先级高于节点2，因此VIP在节点1上面
[root@lb01 ~]# ip addr | grep 10.0.0.3
inet 10.0.0.3/32 scope global eth0

3.2 关闭节点1的keepalived

[root@lb01 ~]# systemctl stop keepalived

#节点2联系不上节点1，主动接管VIP
[root@lb02 ~]# ip addr | grep 10.0.0.3
inet 10.0.0.3/32 scope global eth0

3.3 此时从新启动Master上的keepalived，会发现VIP被强行抢占

[root@lb01 ~]# systemctl start keepalived
[root@lb01 ~]# ip addr | grep 10.0.0.3
    inet 10.0.0.3/32 scope global eth0

3.4 配置非抢占式

一、两个节点的state都必须配置为BACKUP
二、两个节点都必须加上配置 nopreempt
三、其中一个节点的优先级必需要高于另一个节点的优先级。
两台服务器都角色状态启用nopreempt后，必须修改角色状态统一为BACKUP，惟一的区分就是优先级。

Master配置
    vrrp_instance VI_1 {
        state BACKUP
        priority 150
        nopreempt
    }

Backup配置
    vrrp_instance VI_1 {
        state BACKUP
        priority 100
        nopreempt
    }

3.5 经过windows的arp去验证，是否会切换MAC地址

#查看VIP在节点1上面
[root@lb01 ~]# ip addr | grep 10.0.0.3
    inet 10.0.0.3/32 scope global eth0

#windows查看Mac地址

#将节点1的keepalived停掉
[root@lb01 ~]# systemctl stop keepalived

#节点2接管VIP
[root@lb02 ~]# ip addr | grep 10.0.0.3
    inet 10.0.0.3/32 scope global eth0

#再次查看mac地址
arp -a

4. 高可用keepalived故障脑裂

因为某些缘由，致使两台keepalived高可用服务器在指定时间内，没法检测到对方的心跳，个字去的资源及服务的全部权，而此时的两台高可用服务器又都还活着。

4.1 脑裂故障缘由

一、服务器网线松动等网络故障
二、服务器硬件故障发生损坏现象而崩溃
三、主备都开启firewalld防火墙

4.2 脑裂故障现象

#将节点1和节点2的防火墙都打开
[root@lb01 ~]# systemctl start firewalld

[root@lb02 ~]# systemctl start firewalld

#fireshark抓包查看

4.3 解决脑裂故障方案

#若是发生闹裂，则随机kill掉一台便可
#在备上编写检测脚本, 测试若是能ping通主而且备节点还有VIP的话则认为产生了列脑
[root@lb02 ~]# cat check_split_brain.sh
#!/bin/sh
vip=10.0.0.3
lb01_ip=10.0.0.5
while true;do
    ping -c 2 $lb01_ip &>/dev/null
    if [ $? -eq 0 -a `ip add|grep "$vip"|wc -l` -eq 1 ];then
        echo "ha is split brain.warning."
    else
        echo "ha is ok"
    fi
sleep 5
done

5. 高可用keepalived与nginx

5.1 为何域名解析到VIP就能够访问nginx？

Nginx默认监听在全部的IP地址上，VIP会飘到一台节点上，至关于那台nginx多了VIP这么一个网卡，因此能够访问到nginx所在机器

5.2 若是nginx宕机，会致使用户请求失败，可是keepalived没有挂掉不会进行切换，因此须要编写一个脚本检测Nginx的存活状态，若是不存活则kill掉keepalived

[root@lb01 ~]# mkdir /server/scripts
[root@lb01 ~]# vim /server/scripts/check_web.sh
#!/bin/sh
nginxpid=$(ps -C nginx --no-header|wc -l)

#1.判断Nginx是否存活,若是不存活则尝试启动Nginx
if [ $nginxpid -eq 0 ];then
    systemctl start nginx
    sleep 3
    #2.等待3秒后再次获取一次Nginx状态
    nginxpid=$(ps -C nginx --no-header|wc -l) 
    #3.再次进行判断, 如Nginx还不存活则中止Keepalived,让地址进行漂移,并退出脚本  
    if [ $nginxpid -eq 0 ];then
        systemctl stop keepalived
   fi
fi
#给脚本增长执行权限
[root@lb01 ~]# chmod +x /server/scripts/check_web.sh

5.3 在lb01主机的keepalived配置文件中调用此脚本

[root@lb01 ~]# cat /etc/keepalived/keepalived.conf
global_defs {           
    router_id lb01      
}

#每5秒执行一次脚本，脚本执行内容不能超过5秒，不然会中断再次从新执行脚本
vrrp_script check_web {
    script "/server/scripts/check_web.sh"
    interval 5
}

vrrp_instance VI_1 {
    state MASTER        
    interface eth0      
    virtual_router_id 50    
    priority 150        
    advert_int 1        
    authentication {    
        auth_type PASS  
        auth_pass 1111  
    }
    virtual_ipaddress { 
        10.0.0.3    
    }


#调用并运行脚本
track_script {
    check_web
}
}
#在Master的keepalived中调用脚本，抢占式，仅需在master配置便可。（注意，若是配置为非抢占式，那么须要两台服务器都使用该脚本）