Sentry: o detetive que encontra os erros que seus usuários nem te contaram
Sentry captura cada exception em produção, agrupa os similares, mostra o stack trace e até o que o usuário clicou antes do erro. Você vê antes do cliente reclamar.
Sentry captura cada exception em produção, agrupa os similares, mostra o stack trace e até o que o usuário clicou antes do erro. Você vê antes do cliente reclamar.
Grafana transforma métricas e logs em painéis visuais incríveis. Funciona com Prometheus, InfluxDB, Loki e muito mais. Aprenda a criar o seu dashboard aqui.
Latência, taxa de erro, uso de CPU e fila de processamento. Saber o que medir e o que ignorar é o que separa um sistema que aguenta da pipoca que estoura no pior momento.
Chega de biblioteca diferente pra cada ferramenta de observabilidade. OpenTelemetry unifica tudo num SDK só compatível com qualquer backend. Guia de adoção aqui.
Microsserviços têm um problema: quando dá errado, você não sabe onde. Distributed tracing resolve isso mostrando o caminho completo da requisição. Como funciona aqui.
Quanto do tempo seu sistema pode ficar fora do ar? 99.9%? 99.99%? SLO é essa meta. Error budget é o saldo que resta. Quando acaba, você para de lançar feature. Faz sentido!
SLI é a medição técnica do que importa pro usuário: latência, erro, disponibilidade. Antes de definir meta, você precisa medir. Aqui explico quais medir e por quê.
Throughput é a capacidade do sistema — quantas coisas ele processa por segundo. Medir errado leva a surpresa em produção. Aprenda a medir, interpretar e melhorar.
Aplicação quebrando sem você saber por que e um pesadelo. Observabilidade e ter olhos dentro do sistema — logs, metricas e traces trabalhando juntos para te contar o que realmente esta acontecendo.
Log e so uma linha de texto? Não quando você precisa debugar produção as 3 da manhã. Log estruturado em JSON com campos padronizados torna a busca por problemas infinitamente mais rápida.
Aplicação lenta, usuário reclamando e você sem ideia de onde esta o problema. Observabilidade e ter instrumentação suficiente para responder isso rápido. Entenda metricas, logs e traces trabalhando juntos.