Dashboard

Pare de escrever regras de alerta. Os agentes leem seus logs e decidem.

Entrar na lista de espera
Issues Critical latency degradation in checkout-edge worker Overview

Critical latency degradation in checkout-edge worker

Incident critical Polylane ·Detected 3 hours ago ·Last seen 4 minutes ago ·2 occurrences
OverviewInvestigationMetricsTimelineProperties
checkout-edge Cloudflare Worker

Critical latency degradation detected in checkout-edge worker: 18x+ P99 latency spikes sustained for 12 minutes

Causal metrics All metrics
Request Duration
414 ms ▲ 43.1σ
Wall Time
416 ms ▲ 43.0σ
CPU Time
14 ms ▲ 2.6σ
Blast radius
Search your cloud resources...
Graph Table
edge-gateway Cloudflare Worker ··· checkout-edge Cloudflare Worker ··· hd-prod Hyperdrive ··· payments-db PlanetScale ··· cart-svc Cloudflare Worker ···
Analysis Copy

Deploy 9f3c2a1 shrank the Hyperdrive pool hd-prod from 50 connections to 5. Under checkout load, requests queue on connection checkout and P99 rises 18× against the 30-minute baseline. Restoring the pool size restores latency.

Tags
service · checkout-edgeprovider · cloudflaredeploy · 9f3c2a1signal · wall_time_p99

Um pico não é um incidente. O Polylane sabe a diferença.

  • Seus gráficos viram verificações

    Tudo o que seu time já coloca em gráfico passa a ser observado: salve uma query ou monte um dashboard e o Polylane pega dali.

  • Linhas de base que conhecem seu tráfego

    O normal às 14h de uma terça não é o normal às 2h de um domingo. O Polylane compara com o seu ritmo, não com uma linha reta.

  • Oscilações são ignoradas

    Um movimento precisa ser grande, sustentado e na direção que piora. Picos isolados são descartados.

  • Um agente toma a decisão

    Ele olha o quadro inteiro, inclusive o que mudou recentemente. A resposta padrão é que nada está errado.

  • Evidências anexadas

    Quando algo está errado, você recebe as queries exatas por trás do achado, não um gráfico e um boa sorte.

Alguns problemas nunca formam um pico. O Polylane lê em busca deles também.

Um fluxo constante de crashes parece plano em qualquer gráfico, então os agentes também leem os próprios logs. E alguns estados estão errados em qualquer linha de base: um CrashLoopBackOff não precisa de julgamento, um limiar simples o pega na hora.

Você não pode observar a produção o dia inteiro. O Polylane pode.