diff --git a/VERSION b/VERSION index 2fe9589..7c2791e 100644 --- a/VERSION +++ b/VERSION @@ -1 +1 @@ -1.3.9 \ No newline at end of file +1.3.10 \ No newline at end of file diff --git a/packaging/scripts/keepalived-master.sh b/packaging/scripts/keepalived-master.sh index 282071c..0dc82d2 100644 --- a/packaging/scripts/keepalived-master.sh +++ b/packaging/scripts/keepalived-master.sh @@ -4,8 +4,20 @@ # KEIN Auto-Promote — Split-Brain-Schutz durch manuelle Promotion. # Admin muss "edgeguard-ctl promote" ausführen wenn PG-Failover gewünscht. -logger -t keepalived -p daemon.warning \ - "MASTER: VIP übernommen — PG-Rolle ist noch '$(cat /var/lib/edgeguard/pg_role 2>/dev/null || echo standby)'. Für PG-Failover: edgeguard-ctl promote" +# PG-Rolle ZUVERLÄSSIG über die Publication ermitteln — nicht über die evtl. +# veraltete/fehlende Datei /var/lib/edgeguard/pg_role (die schrieb nur `promote`; +# ein via cluster-init-replication eingerichteter Primary hat sie nie → Log sagte +# fälschlich "standby"). Nur der Primary trägt die Publication edgeguard_shared +# (Konvention, vgl. cluster_repair.go). Best-effort: bei psql-Fehler neutral. +if sudo -u postgres psql -d edgeguard -tAc \ + "SELECT EXISTS(SELECT 1 FROM pg_publication WHERE pubname='edgeguard_shared')" \ + 2>/dev/null | grep -q '^t$'; then + logger -t keepalived -p daemon.warning \ + "MASTER: VIP übernommen — dieser Node ist bereits PG-Primary (kein promote nötig)." +else + logger -t keepalived -p daemon.warning \ + "MASTER: VIP übernommen — PG-Rolle ist 'standby'. Für PG-Failover: edgeguard-ctl promote" +fi # ── Upstream-ARP/Routing für die Failover-VIP(s) aktualisieren ── # Manche Hoster lernen die neue MAC einer Failover-IP NICHT zuverlässig über