<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="en">
	<id>https://wiki.tetrain.com/index.php?action=history&amp;feed=atom&amp;title=PCS_Cluster_failover-process</id>
	<title>PCS Cluster failover-process - Revision history</title>
	<link rel="self" type="application/atom+xml" href="https://wiki.tetrain.com/index.php?action=history&amp;feed=atom&amp;title=PCS_Cluster_failover-process"/>
	<link rel="alternate" type="text/html" href="https://wiki.tetrain.com/index.php?title=PCS_Cluster_failover-process&amp;action=history"/>
	<updated>2026-07-27T11:09:36Z</updated>
	<subtitle>Revision history for this page on the wiki</subtitle>
	<generator>MediaWiki 1.43.9</generator>
	<entry>
		<id>https://wiki.tetrain.com/index.php?title=PCS_Cluster_failover-process&amp;diff=4327&amp;oldid=prev</id>
		<title>Admin: Auto-created from uploaded PDF text extraction</title>
		<link rel="alternate" type="text/html" href="https://wiki.tetrain.com/index.php?title=PCS_Cluster_failover-process&amp;diff=4327&amp;oldid=prev"/>
		<updated>2026-07-26T16:27:10Z</updated>

		<summary type="html">&lt;p&gt;Auto-created from uploaded PDF text extraction&lt;/p&gt;
&lt;p&gt;&lt;b&gt;New page&lt;/b&gt;&lt;/p&gt;&lt;div&gt;&amp;#039;&amp;#039;Auto-generated from the uploaded PDF [[:File:PCS_Cluster_failover-process.pdf|PCS_Cluster_failover-process.pdf]]. This is an extracted-text rendering for searchability; see the original PDF for exact formatting, diagrams, tables, and images.&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
&amp;lt;nowiki&amp;gt;&lt;br /&gt;
SOP: PCS Cluster Working Process &amp;amp; Failover&lt;br /&gt;
Management&lt;br /&gt;
Cluster Details&lt;br /&gt;
&lt;br /&gt;
      Cluster Name: nagios_cluster&lt;br /&gt;
      Cluster Stack: Corosync / Pacemaker&lt;br /&gt;
      Preferred Node: app2-2.spectra.co&lt;br /&gt;
      Failover Node: app2-1.spectra.co&lt;br /&gt;
      DRBD Resource: r0&lt;br /&gt;
      MySQL: Master-Master Replication&lt;br /&gt;
      DRBD Mount Point Resource: fs_drbd&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
1. Normal Cluster Behavior&lt;br /&gt;
      By default, all resources (VIP, DRBD master, services) are hosted on app2-&lt;br /&gt;
       2.spectra.co.&lt;br /&gt;
      If app2-2.spectra.co becomes unreachable or is manually set to standby, cluster&lt;br /&gt;
       resources failover to app2-1.spectra.co.&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
2. Failover Behavior&lt;br /&gt;
      When app2-2.spectra.co is offline/unreachable, resources move to app2-&lt;br /&gt;
       1.spectra.co.&lt;br /&gt;
      Once app2-2.spectra.co comes back online, PCS automatically migrates resources&lt;br /&gt;
       back to the preferred node (as per location constraints).&lt;br /&gt;
      This migration may take a few minutes depending on service/resource status.&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
3. Manual Standby &amp;amp; Recovery Steps&lt;br /&gt;
Put Node in Standby&lt;br /&gt;
&lt;br /&gt;
pcs node standby app2-2.spectra.co&lt;br /&gt;
Un-standby Node (Bring Back to Cluster)&lt;br /&gt;
&lt;br /&gt;
pcs node unstandby app2-2.spectra.co&lt;br /&gt;
&lt;br /&gt;
4. Cleanup Failed Resource Actions&lt;br /&gt;
After any failover or recovery, always clean failed resource states:&lt;br /&gt;
&lt;br /&gt;
pcs resource cleanup&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
5. Verification Steps After Failover or Recovery&lt;br /&gt;
A. Check DRBD Sync Status&lt;br /&gt;
&lt;br /&gt;
drbdadm status r0&lt;br /&gt;
&lt;br /&gt;
      Ensure both nodes are in sync.&lt;br /&gt;
      Preferred node should show as Primary.&lt;br /&gt;
&lt;br /&gt;
B. Check MySQL Replication (Master-Master)&lt;br /&gt;
&lt;br /&gt;
 mysql -e &amp;quot;SHOW SLAVE STATUS\G&amp;quot;&lt;br /&gt;
&lt;br /&gt;
      Look for Seconds_Behind_Master, Slave_IO_Running, Slave_SQL_Running values.&lt;br /&gt;
      Both should show replication in healthy state.&lt;br /&gt;
&lt;br /&gt;
C. Check Cluster Status&lt;br /&gt;
&lt;br /&gt;
pcs status&lt;br /&gt;
&lt;br /&gt;
 Verify all resources are running on the correct node ( app2-2.spectra.co).&lt;br /&gt;
&lt;br /&gt;
 Example:&lt;br /&gt;
&lt;br /&gt;
* Promoted: [ app2-2.spectra.co ]&lt;br /&gt;
&lt;br /&gt;
* Started: [ app2-2.spectra.co ]&lt;br /&gt;
&lt;br /&gt;
6. Logs &amp;amp; History&lt;br /&gt;
Check logs for any anomalies:&lt;br /&gt;
&lt;br /&gt;
journalctl -xe | grep pacemaker&lt;br /&gt;
&lt;br /&gt;
cat /var/log/pacemaker.log&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
7. Important Notes&lt;br /&gt;
      Always verify DRBD and MySQL replication after failover or maintenance.&lt;br /&gt;
      Ensure fencing (fence_ipmilan) is working correctly for both nodes.&lt;br /&gt;
      If frequent failures occur, check the monitor action results and logs for root cause.&lt;br /&gt;
&amp;lt;/nowiki&amp;gt;&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;/div&gt;</summary>
		<author><name>Admin</name></author>
	</entry>
</feed>