Pare de escrever regras de alerta. Os agentes leem seus logs e decidem.
Entrar na lista de esperaCritical latency degradation in checkout-edge worker
Critical latency degradation detected in checkout-edge worker: 18x+ P99 latency spikes sustained for 12 minutes
Deploy 9f3c2a1 shrank the Hyperdrive pool
hd-prod from 50 connections to 5. Under checkout load,
requests queue on connection checkout and P99 rises 18× against the 30-minute baseline. Restoring the pool size restores latency.
Um pico não é um incidente. O Polylane sabe a diferença.
-
Seus gráficos viram verificações
Tudo o que seu time já coloca em gráfico passa a ser observado: salve uma query ou monte um dashboard e o Polylane pega dali.
-
Linhas de base que conhecem seu tráfego
O normal às 14h de uma terça não é o normal às 2h de um domingo. O Polylane compara com o seu ritmo, não com uma linha reta.
-
Oscilações são ignoradas
Um movimento precisa ser grande, sustentado e na direção que piora. Picos isolados são descartados.
-
Um agente toma a decisão
Ele olha o quadro inteiro, inclusive o que mudou recentemente. A resposta padrão é que nada está errado.
-
Evidências anexadas
Quando algo está errado, você recebe as queries exatas por trás do achado, não um gráfico e um boa sorte.
Alguns problemas nunca formam um pico. O Polylane lê em busca deles também.
Um fluxo constante de crashes parece plano em qualquer gráfico, então os agentes também leem os próprios logs. E alguns estados estão errados em qualquer linha de base: um CrashLoopBackOff não precisa de julgamento, um limiar simples o pega na hora.