Dashboard

O trabalho de infraestrutura para o qual ninguém foi contratado. Mapeado, observado e mantido honesto por agentes.

Entrar na lista de espera

Um grafo, todos os provedores. Não um diagrama que você mantém: um grafo que se sincroniza sozinho.

Topology
Search your cloud resources...
Galaxy
checkout-edge Worker
Critical Critical to your architecture.

Issue hotspot: 4 issues in the last 7 days

Change hotspot: 12 changes in the last 7 days

Cloudflare · coreplane · earth · Compute
hd-prod Hyperdrive
Critical Critical to your architecture.

Change hotspot: 7 changes in the last 7 days

Cloudflare · coreplane · earth · Databases
ingest-events Lambda function
Standard Important to your architecture.

Issue hotspot: 2 issues in the last 7 days

AWS · coreplane-prod · us-east-1 · Compute
payments-db Database
Critical Critical to your architecture.

Issue hotspot: 1 issue in the last 7 days

Change hotspot: 3 changes in the last 7 days

PlanetScale · coreplane · us-east · Databases

Cada mudança fica registrada. Doze minutos antes da regressão, alguém mexeu na fila.

Clouds prod-aws Changes

SQS visibility timeout lowered on checkout-events

Moderate impact configuration ·Synced 12 minutes ago

VisibilityTimeout on checkout-events dropped from 120s to 15s. Consumers that hold a message longer than 15 seconds will see it delivered twice; the dead-letter queue threshold is unchanged.

What we're watching
ApproximateAgeOfOldestMessage
checkout-events · baseline at change 3.2s · worse if up
Watching: no issue since this change
NumberOfMessagesReceived
checkout-events · baseline at change 41/min · worse if up
Watching: no issue since this change
Triggering events
SetQueueAttributes CloudTrail · deploy-bot · 12:41:02Z attached to this record's delta window
Full diff (3 changes)
Nodes (2) Edges (1)
2 nodes modified · 1 edge removed

As partes silenciosas, observadas. O cron travado, a fila crescendo, o worker que parou.

Issues reconcile-orders stopped running Overview

reconcile-orders stopped running

High Incident ·Detected by Polylane
OverviewMetricsLogsTracesTimelineProperties
What changed
  • runs/day 4 → 0: no successful run since Tue 02:00 UTC
  • last attempt exited with code 137 after 91s (Tue 02:01)
  • peak memory on the final run was 2.4× the previous seven-day average
Why it matters

Orders placed since Tuesday have no reconciliation record. The finance export and the daily revenue report both read from the table this job writes.

Suggested investigation steps
  1. 1. Read the logs from the last attempt on reconcile-orders
  2. 2. Check for memory limit or plan changes on the service in the change records
  3. 3. Confirm the schedule still exists in render.yaml on main
Investigate Detected 02:31 UTC · 30 minutes after the missed run

Como o Polylane funciona. Ele aprende seu sistema, observa, investiga e age.

  • Ele aprende seu sistema primeiro

    O grafo de contexto mapeia cada recurso e dependência entre suas nuvens, repositórios e provedores de observabilidade. Os agentes raciocinam sobre a topologia real, não sobre palpites.

  • Detecção sem limiares

    Verificações integradas para cada provedor, mais verificações geradas a partir das suas próprias queries salvas e dashboards. Uma passagem estatística e um agente decidem juntos, e uma melhoria nunca abre uma issue.

  • Investigações que mostram evidências

    Cada afirmação aponta de volta para a query, a linha de log ou o registro de mudança por trás dela. Um veredito sem evidência recua para inconclusivo.

  • Escritas se conquistam, nunca se presumem

    As contas se conectam em modo somente leitura. Rollbacks ficam desativados por padrão, com limite de taxa e registrados. Mudanças de código passam pela sua revisão normal.

  • Ele fica mais afiado a cada semana

    Memórias, notas diárias e queries de monitoramento reconfirmadas contra dados reais: a investigação de julho aprende com a de junho.

Ele se conecta ao que você já roda. Conecte em modo somente leitura e comece.

Perguntas.

Quais provedores o Polylane suporta hoje?

AWS, Cloudflare, Vercel, Render, Fly.io, Kubernetes, PlanetScale, Supabase e Modal, mais GitHub para código e Datadog, Honeycomb, Axiom, Grafana Cloud e Sentry para telemetria. A página de integrações acompanha o catálogo completo, inclusive o que vem a seguir.

Como ele liga recursos entre nuvens?

Do jeito que o tráfego realmente flui: hostnames, registros DNS e endereços IP casados entre provedores, variáveis de ambiente que revelam dependências, traces onde você os tem e infraestrutura como código que declara o que é implantado onde.

Preciso marcar recursos com tags ou desenhar a topologia?

Não. Conecte cada conta em modo somente leitura e o grafo se constrói e se mantém sozinho. Você pode corrigir ou anotar qualquer coisa, e os agentes o mantêm atualizado a cada sincronização.

Quanto acesso cada nuvem precisa?

O mínimo, somente leitura por padrão: AWS por meio de uma role do CloudFormation com escopo, Cloudflare por permissões de token pré-preenchidas, e equivalentes em todos os outros. Acesso de escrita é uma decisão separada, por conta.

Quais sistemas em segundo plano ele observa?

O que seus provedores rodam: filas SQS e jobs agendados na AWS, Cloudflare Queues, background workers e cron jobs do Render, CronJobs do Kubernetes, máquinas do Fly.io. Se está em uma conta conectada, está no grafo.

Mais casos de uso

Conecte suas nuvens. O grafo se constrói sozinho.