~ / observabilidade
Observabilidade
Observabilidade não é só “ter Grafana”. É conseguir responder o que quebrou, onde e por quê — com métricas, logs e traces correlacionados, sem depender de chute em produção.
A IRN Devs monta e opera stacks de observabilidade no homelab e em projetos de clientes, com alertas acionáveis e handoff documentado para o time que mantém o sistema no dia a dia.
$ os três pilares (na prática)
- Métricas — uso de CPU, latência, taxa de erro; base para dashboards e SLOs simples.
- Logs — o “o que aconteceu” em texto estruturado; essencial para auditoria e debug.
- Traces — o caminho de uma requisição entre serviços; o que separa “achismo” de causa raiz.
Stacks típicas incluem Prometheus/Grafana, Loki e OpenTelemetry — sempre dimensionadas ao tamanho do ambiente (homelab ≠ cluster enterprise).
$ o que evita alertas inúteis
Alerta demais cansa o time; alerta de menos atrasa o incidente. O desenho certo prioriza sinais que exigem ação (disco cheio, taxa de erro alta, healthcheck falhando) e documenta quem responde e como.