Single Point of Failure: semua service di 1 VM / 1 node #4

Open
opened 2026-10-11 06:57:52 +00:00 by reza · 0 comments
Owner

Kondisi sekarang: Caddy, Zitadel, Forgejo, Stalwart, Bulwark, Postgres semua di VM 1030 pada node Prox-P1337-B. Zitadel = SSO untuk Forgejo dan webmail → jika mati, login semua layanan ikut mati.

Risiko: 1 kegagalan = seluruh layanan down; tidak ada failover.

Usulan:

  • Pisahkan peran (minimal IAM/mail terpisah dari Git) atau siapkan replika + load balancer.
  • Minimal: snapshot/restore cepat + dokumentasi RTO.
  • Pertimbangkan HA Zitadel/Postgres (replikasi) jangka menengah.

Selesai bila:

  • RPO/RTO ditetapkan
  • Ada jalur pemulihan cepat yang teruji
  • (Ideal) tidak ada satu komponen yang mematikan semua layanan
**Kondisi sekarang:** Caddy, Zitadel, Forgejo, Stalwart, Bulwark, Postgres semua di VM 1030 pada node `Prox-P1337-B`. Zitadel = SSO untuk Forgejo **dan** webmail → jika mati, login semua layanan ikut mati. **Risiko:** 1 kegagalan = seluruh layanan down; tidak ada failover. **Usulan:** - Pisahkan peran (minimal IAM/mail terpisah dari Git) atau siapkan replika + load balancer. - Minimal: snapshot/restore cepat + dokumentasi RTO. - Pertimbangkan HA Zitadel/Postgres (replikasi) jangka menengah. **Selesai bila:** - [ ] RPO/RTO ditetapkan - [ ] Ada jalur pemulihan cepat yang teruji - [ ] (Ideal) tidak ada satu komponen yang mematikan semua layanan
Sign in to join this conversation.
No description provided.