Pular para o conteúdo

Stack de Observabilidade

A pilha de observabilidade da Serigy é OpenTelemetry → Tempo → Prometheus → Grafana. Cada peça tem um papel claro e padronizado, evitando lock-in de instrumentação.

flowchart LR
    subgraph fontes["Fontes"]
        A["Aplicações"]
        K["RKE / Kubernetes"]
        E["eBPF / Tetragon"]
    end
    A & K & E --> OTel["OpenTelemetry Collector"]
    OTel -->|traces| Tempo["Grafana Tempo"]
    OTel -->|métricas| Prom["Prometheus"]
    Tempo --> Graf["Grafana"]
    Prom --> Graf
    Graf --> Dash["Dashboards"]
    Graf --> Alerts["Alertas"]
ComponentePapel
OpenTelemetryInstrumentação e coleta padronizada (métricas, traces, logs). Um collector recebe de tudo e distribui.
TempoBackend de tracing distribuído — guarda e consulta os traces.
PrometheusSéries temporais de métricas; regras de alerting.
GrafanaVisualização unificada (métricas + traces + logs), dashboards e alertas.
  • OpenTelemetry desacopla a instrumentação dos backends — trocar uma peça não exige reinstrumentar as aplicações.
  • Tempo + Prometheus + Grafana são integrados e amplamente usados, com baixo custo operacional.
  • Correlacionar métrica → trace → log no Grafana acelera tanto o diagnóstico de operação quanto a investigação de segurança.

A pilha de observabilidade é um serviço de plataforma, candidato natural ao cluster de gestão ou a um namespace dedicado, coletando dos três clusters RKE pela malha privada.