Полный текст

Как построить отказоустойчивый PostgreSQL-кластер и не промахнутьсяПроизошёл failover, и время ответа подскочило с 10 до 4000 мс. Локальный EXPLAIN ANALYZE в норме, но система висит. Проблема кроется в петле маршрутизации трафика между дата-центрами.Один инстанс СУБД — это точка отказа. Выживание даёт правильная обвязка. Связка DCS (etcd или Consul), оркестратора (Patroni) и пулера (PgBouncer) формирует стабильный контур. Но размещение etcd на одном узле с базой грозит ложными перевыборами лидера из-за просадок I/O.Изучим архитектуру надёжного кластера.