作家
登录

Linux之HA高可用集群的基础概念总结

作者: 来源: 2017-12-21 15:06:10 阅读 我要评论

若何避免脑裂?

在进行资本转移之前先将本来的节点进行资本隔离:

1. 节点隔离

  Stonish设备 如 直接断电爆头,一发明某节点无法传输heartbeat直接给其断电

2. 资本级别隔离

  FC-SAN (光纤交换机)可以实如今存储资本隔离故障节点的拜访

若何检猜一?节点是否故障?

1. 加仲裁磁盘 主节点往一个共享磁盘中赓续写入数据,一旦备节点发明本身可以拜访共享磁盘但未发明主节点写入数据,则可以认为主节点挂掉落,进行隔离

3. watchdog看门狗,调和同一个节点上不合过程每隔一段时光往watchdog中写入数据,一旦写入中断watchdog会测验测验重启此过程,如不雅重启不了,则此节点故障,大年夜此集群中去掉落

Massaging Layer(负责以UDP协定在主节点与备节点间以组播模式传输heartbeat,资本黏性,资本束缚,等信息),Massaging Layer 也是一个办事(UDP/694),且要让婷勃机自启动。

Cluster Resource Manager(集群的资本治理器):专门处理统计收集群膳绫强个资本的状况如:资本黏性资本束缚,节点是否健康;并又CRM的子件PE计算出资本如今应当运行在哪个节点上,再由CRM的子件TE批示每个节点的LRM完成响应操作如:将办事大年夜A节点迁徙到B,在B节点上启用VIP,文件体系.....

高可用集群节点上的办事启动都要由CRM决定,不克不及让其自启动,所以必须#chkocnfig 办事名称 off

2. clone  每个节点上都运行此资本。

PE:policy engine 策略引擎

2. crm + heartbeat v2

LRM:location Resource Manager 本地资本治理器

PE,TE,LRM都是CRM的构成

RA:Resource Agent资本代劳

所有可以或许负责资本启动、封闭、重启、状况监测的脚本都叫RA,RA运行在每个节点上

RA的类别

LSB 所有遵守linux的shell编程支撑start|restart|stop|status的脚本都是LSB类型 如/etc/rc.d/init.d/目次中的所有脚本

OCF(open cluster framework)词攀类脚本不只可以接收start|restart|stop|status等参数,甚至可以接收monitior(监控)等参数

DC(designated coordinator)事物调和员,DC也为CRM的子件,是在多节点中选举出的一个节点

Messager Layer的软件实现

1. heartbeat(v1 v2 v3 三个版本)

2. heartbeat v3 又分为heartbeat、pacemaker、cluster-glue

3. CoroSync 红帽6.0后默认应用的Messaging Layer

4. Cman  红帽5.0后默认应用的Messaging Layer 但因为工作在内核空间且设备复杂所以6.0后换成了工作在用户空间的CoroSync

5. keepalived keepalived的设备与应用与前几个比拟有所不合,如对VIP的设备是基于VRRP(Virtual Router Redundancy Protocol)虚拟路由冗余协定实现的

CRM(cluster resource manager)层的软件实现

CRM必须工作在Messaging Layer 层上


1. Haresources (heartbeat v1 v2 都有自带)

2. CRM (heartbeat v2 自带)

3. Pacemaker (heartbeat v3 自力出去的项目)

4. Ragmanager (专门为Cman供给的一种crm)

所以集群的Messager Layer与CRM 组合如下:

1. haresource + heartbeat v1/v2

2. FIP(float IP)流动的IP,可以再节点之间转移

3. pacemaker + corosync

1. colocation(分列束缚):定义不合伙源可否运行在同一个节点上,Score>0(可以),Score<0(弗成以)

5. cman + ragmanager

那么定义一个Web办事的高可用集群至少要几个节点?要定义几个资本?

至少须要两个节点,膳绫擎要运行MassagerLayer 和 CRM

至少要定义四个资本 VIP 、httpd办事 、Filesystem、Stonish设备

为了避免随便一个办事器配好资本,装上MassagerLayer和CRM,时光再一同步就可以随便参加我们的集群体系,该若何处理?

Legency heartbeat v1 RA

起首每个节点要装Messager Layer和CRM节点之间进行heartbeat等信息传输时都因该采取加密传输(如进行hash运算), 如不雅有两个节点可以进行单播传输heartbeat信息,两个以上节点可以进行单播、组播、广播传输heartbeat信息,高等可用集群节点上的办事必须由CRM控制,所以要设置CRM自启动而办事要用chkconfig封闭开机自启动,而Massager Layer也是一个办事且要开机自启动,Messager Layer监听在UDP/694上,以UDP协定在Messager Layer层传输heartbeat等信息。

如不雅要设备一个HA集群要留意什么?

节点名称要与uname -n的结不雅一致;节点名称/IP的解析最好在/etc/hosts文件中,不要用DNS解析,不然DNS-Server挂掉落会对集群造成影响;节点的时光必须同步;SSH互信通信(当要停止或其他节点的HA集群办事时,不克不及大年夜此节点进行,而要年腋荷琐正常的节点进行HA办事的封闭或启动)这是就必须请求可以或许以SSH长途登录到其他节点。

那第一个节点怎么办?

第一个节点要自我启动,然后启动其他节点上的办事

【编辑推荐】

  1. 若何为Linux无线网卡设备无线唤醒功能
  2. 【推荐】十个不错的Linux收集监督对象
  3. Linux DNS办事器安装、设备和保护
  4. 用体系日记懂得你的Linux体系
  5. 嵌入式Linux体系在线进级策略
【义务编辑:庞桂玉 TEL:(010)68476606】

  推荐阅读

  人工智能让智能锁具有“思维”,切中用户的痛点

【限时免费】岁尾最强一次云计算大年夜会,看传统、社区、互联网企业若何碰撞? 偏门行业,偏偏成长潜力巨大年夜,特别是门锁颐魅正处在大年夜传统门锁到智能门锁转型的关键风口。据有关数>>>详细阅读


本文标题:Linux之HA高可用集群的基础概念总结

地址:http://www.17bianji.com/lsqh/40048.html

关键词: 探索发现

乐购科技部分新闻及文章转载自互联网,供读者交流和学习,若有涉及作者版权等问题请及时与我们联系,以便更正、删除或按规定办理。感谢所有提供资讯的网站,欢迎各类媒体与乐购科技进行文章共享合作。

网友点评
自媒体专栏

评论

热度

精彩导读
栏目ID=71的表不存在(操作类型=0)