设置:操作系统:CentOS 7,最新版本Corosync,Pacemaker&PCS – 两个节点主动/主动群集,虚拟IP – 两个节点上Exim运行在远程邮件(SMTP),没有什么特别的configuration – 当Exim在其中一个节点上失败,节点不应该参与回复虚拟IP,直到Exim恢复运行 我试图得到这个工作: – 克隆ocf:心跳:虚拟IP的IPaddr2资源 – 克隆systemd:Exim资源观看Exim与on-fail =“待机”选项 问题:最初,一切工作都应该如此。 当其中一个节点无法运行Exim时,它会正确停止,并且该节点不再参与虚拟IP。 问题是,在停止和启动其中一个节点之后,Exim重新启动(因为它应该),但监视器返回“不运行”。 当Exim-resource没有configurationon-fail =“standby”时,一切都按照devise工作,我可以按照自己的想法启动/停止Exim和其中一个节点。 消息在日志中: Jan 28 16:17:30 testvm101 crmd[14183]: notice: process_lrm_event: LRM operation exim:0_monitor_30000 (call=141, rc=7, cib-update=211, confirmed=false) not running Jan 28 16:17:30 testvm101 crmd[14183]: warning: status_from_rc: Action 20 (exim:0_monitor_30000) on testvm101 failed (target: 0 vs. rc: 7): Error […]
这是问题继续。 所以,我有一个vlan中的两个testing服务器。 srv1 eth1 10.10.10.11 eth2 10.20.10.11 srv2 eth1 10.10.10.12 eth2 10.20.10.12 Cluster VIP – 10.10.10.100 具有两个接口的Corosyncconfiguration: rrp_mode: passive interface { ringnumber: 0 bindnetaddr: 10.10.10.0 mcastaddr: 226.94.1.1 mcastport: 5405 } interface { ringnumber: 1 bindnetaddr: 10.20.10.0 mcastaddr: 226.94.1.1 mcastport: 5407 } 起搏器configuration: # crm configure show node srv1 node srv2 primitive P_INTRANET ocf:pacemaker:ping \ params […]
我有一个简单的3节点起搏器/ corosync设置。 Ubuntu 14.04.2。 3个节点,2个资源 – IP – 已configuration。 ii crmsh 1.2.5+hg1034-1ubuntu4 all CRM shell for the pacemaker cluster manager ii pacemaker 1.1.10+git20130802-1ubuntu2.3 amd64 HA cluster resource manager ii pacemaker-cli-utils 1.1.10+git20130802-1ubuntu2.3 amd64 Command line interface utilities for Pacemaker ii corosync 2.3.3-1ubuntu1 amd64 Standards-based cluster framework (daemon and modules) ii libcorosync-common4 2.3.3-1ubuntu1 amd64 Standards-based cluster framework, […]
我有一只兔子mq ha /集群,并由起搏器在两个节点之间共享一个虚拟ip。 问题是,如果整个活动主机closures,起搏器将只能进行故障切换,但是如果rabbit mq在主动主机上closures,则不会起作用。 我不能只添加兔子mq作为资源,因为起搏器将停止被动主机上的服务,这将阻止兔子mq同步消息… 如果兔子mq在主动主机上closures,我该如何进行虚拟ip故障转移? (我正在旅行,所以我不得不在我的电话上填写,我为任何错误而道歉。)
对于心脏起搏器来说,我尝试创build两个节点的第一个簇,但似乎有点奇怪。 遵循本指南 但是不能做f.ex: [root@afnA ~]# pcs property set stonith-enabled=false Error: Unable to update cib Call cib_replace failed (-62): Timer expired 只有我在日志中发现的事情是持续的corosync事件: Nov 06 01:30:54 corosync [TOTEM ] Retransmit List: 96 97 Nov 06 01:30:56 corosync [TOTEM ] Retransmit List: 96 97 Nov 06 01:30:57 corosync [TOTEM ] Retransmit List: 96 97 Nov 06 01:30:59 corosync […]
对于环境和configuration请检查 (7):call = 53,status = complete,last-rc-change ='Mon Jul 13 07:51:32 2015',queued = 0ms,exec = 0ms 我现在添加一个由supervisord控制的服务所以我添加supervisord作为一个资源在PCconfiguration 问题是,在被动节点,我仍然可以启动supervisord,并保持运行,而我理解的正常行为是,电脑应该closures它。 其次,我需要所有的服务来转移到被动节点,即使其中一个死亡,我正在分散服务noda-a和节点-b。 什么是解决这个问题的最佳解决scheme,我在做什么错事?
我有一个slave-ip资源,我想在正常的操作下在一个2节点的PostgreSQL集群中定位到我的从服务器上,以作为只读目的。 一切正常,直到从机节点上的pgsql服务的故障点。 slave-ip资源仍然分配给我的奴隶: Master/Slave Set: pgsql-master [pgsql] Masters: [ pgsql01-test.internal.helloworld ] Stopped: [ pgsql02-test.internal.helloworld ] master-ip (ocf::heartbeat:IPaddr2): Started pgsql01-test.internal.helloworld slave-ip (ocf::heartbeat:IPaddr2): Started pgsql02-test.internal.helloworld 我的约束如下: pcs constraint colocation add master-ip with master pgsql-master pcs constraint colocation add slave-ip with slave pgsql-master score=0 [root@pgsql01-test run]# pcs constraint Location Constraints: Resource: master-ip Enabled on: pgsql01-test.internal.helloworld (score:0) Enabled on: […]
我正在创build一个基于云的群集,所以现在我正在使用uni cast连接到其他的pacemaker / corosync节点。我能够使用私有IP创build一个群集。 要创build跨区域群集,我想使用公有IP。 我尝试使用通用configuration,为memberaddr和节点的公网IP绑定bindnetaddr。 像这样的东西 interface { member { memberaddr: <public ip 1> } member { memberaddr: <public ip 2> } member { memberaddr: <public ip 3> } ringnumber: 0 bindnetaddr: <current nodes public Ip> mcastport: 5405 ttl: 1 } transport: udpu 这不起作用。 难道我做错了什么 ? 所有我可以find的参考是corosync 2.x 谢谢
我正在尝试configuration一个双节点的openais / pacemaker集群,并且很难find信息/教程。 我的目标是在主从复制场景中设置2台MySQL服务器,在这里我可以从两台服务器上读取数据,但只能写入“主”服务器。 因此,我通过交换辅助IP地址来实现复制和手动故障切换 ,并使用my.cnf中的“只读”选项重新configuration新的从站。 现在我想用起搏器自动化。 基本上我希望主IP始终在我可以写入的服务器上 ,并且从IP总是在另一个上 。 如果主服务器上的mysql无法响应,我希望发生故障转移。 这是迄今为止的configuration。 有没有人可以检查我的工作(我肯定是不完整的), 给我一些关于我做错了什么的指针 ? (注意:mysql-master脚本是/etc/init.d下的一个自定义脚本,用于设置/清除只读选项,并重新启动mysql) primitive virtual_master_ip ocf:heartbeat:IPaddr2 \ params ip=192.168.250.xxx.xxx \ op monitor interval=10s primitive virtual_slave_ip ocf:heartbeat:IPaddr2 \ params ip=192.168.xxx.yyy primitive mysql_service ocf:heartbeat:mysql params binary="/usr/bin/mysqld_safe" config="/etc/mysql/my.cnf" \ op minitor interval="60s" timeout="30s" \ meta target-role="Started" primitive mysql_master_role lsb:mysql-master group mysql virtual_master_ip mysql_master virtual_slave_ip colocation […]
你如何获得一个DRBD对的从节点来挂载数据目录,这样数据就可以同步了? 我通过以下指南: https : //wiki.edubuntu.org/ClusterStack/Natty#Prepare_Partitions获得双节点群集设置。 我有连接的节点,但是辅助节点上的数据目录从不装载,因此节点1的数据永远不会复制到节点2。 起搏器“应该”使用以下命令将驱动器安装在节点2上: primitive res_fs ocf:heartbeat:Filesystem params device="/dev/drbd0" directory="/mnt/eoacluster" fstype="ext4" # Mounts the filesystem specifying the DRBD device and mount point. 以下是drdb-overview的输出: 节点1: 0:eoa-ib Connected Primary/Secondary UpToDate/UpToDate C r—- /mnt/eoacluster ext4 99G 188M 94G 1% 节点2: 0:eoa-ib Connected Secondary/Primary UpToDate/UpToDate C r—- 以下是df -h 节点1: Filesystem Size Used Avail Use% Mounted […]