스토리: 새벽에 고객이 "서비스가 안 된다"고 연락, 뭐가 문제인지 모른다
메트릭(Prometheus + Grafana), 로그(Loki + Fluent Bit), 알림(PrometheusRule + Alertmanager)을 구축하여 클러스터에서 무슨 일이 일어나고 있는지 한 화면에서 볼 수 있게 합니다.
| 절 | 제목 |
|---|---|
| 4.1 | 관측 가능성이란 |
| 4.2 | 메트릭 모니터링: Prometheus + Grafana |
| 4.3 | 로그 수집: Loki + Fluent Bit |
| 4.4 | 알림 설정: PrometheusRule |
| 💡 | 마무리: memory에 작업 컨텍스트 기록 |
자세한 내용은 책을 참고하세요.