Tidak ada monitoring, alerting, dan log aggregation #5

Open
opened 2026-10-11 06:57:52 +00:00 by reza · 0 comments
Owner

Kondisi sekarang: tidak ada metrik/alert/log terpusat. Contoh nyata: container zitadel-api berstatus unhealthy tapi tidak ada yang diberi tahu.

Risiko: gangguan tidak terdeteksi, root cause sulit (log hilang saat container restart).

Usulan:

  • node_exporter + Prometheus + Grafana, atau Uptime Kuma (cepat).
  • Log terpusat: Loki/Vector/journald forward.
  • Alert ke email/Telegram untuk down, disk penuh, cert, unhealthy.

Selesai bila:

  • Metrik host & container terkumpul
  • Alert terkirim saat service down
  • Log tersimpan & bisa dicari
**Kondisi sekarang:** tidak ada metrik/alert/log terpusat. Contoh nyata: container `zitadel-api` berstatus **unhealthy** tapi tidak ada yang diberi tahu. **Risiko:** gangguan tidak terdeteksi, root cause sulit (log hilang saat container restart). **Usulan:** - node_exporter + Prometheus + Grafana, atau Uptime Kuma (cepat). - Log terpusat: Loki/Vector/journald forward. - Alert ke email/Telegram untuk down, disk penuh, cert, unhealthy. **Selesai bila:** - [ ] Metrik host & container terkumpul - [ ] Alert terkirim saat service down - [ ] Log tersimpan & bisa dicari
Sign in to join this conversation.
No description provided.