Logo do curso
Curso

Datadog:

observabilidade, troubleshooting e monitoramento inteligente

Quero estudar na alura

12h

Para conclusão

46

Pessoas nesse curso

Certificado

De participação

Introdução_

O que você aprenderá_

  • Defina problemas de observabilidade e estruture métricas customizadas com nomes claros, valores numéricos e timestamps.
  • Adicione e gerencie tags para contextualizar métricas e facilitar buscas e agrupamentos.
  • Transforme e centralize logs brutos em logs estruturados usando parsers e pipelines, criando facets para buscas eficientes.
  • Correlacione métricas e logs para investigar incidentes e reduzir o tempo médio de reparo (MTTR).
  • Configure monitores e alertas inteligentes (Threshold, Outlier, Forecast) e aplique estratégias para reduzir o ruído.
  • Implemente detecção de anomalias com o Watchdog e estabeleça baselines para identificar desvios de comportamento.

Público alvo_

Profissionais de DevOps, SRE, engenheiros de dados e desenvolvedores que já conhecem os conceitos básicos de Datadog e desejam avançar em estratégias práticas de observabilidade para aplicações, com foco em investigação de incidentes e monitoramento em cenários de e-commerce.

Agnes Ruescas

Agnes Ruescas

linkedin

Engenheira de Dados, formada em Engenharia da Computação pela FIAP e pós-graduanda em Engenharia de Dados pela Universidade Presbiteriana Mackenzie. Atua na construção de pipelines, infraestrutura em nuvem e monitoramento de ambientes de dados. Com experiência em DevOps, traz uma visão prática sobre como colocar soluções de dados em produção com qualidade e escalabilidade, conectando teoria e mercado.

Curso atualizado em 16/09/2026

Ementa

  1. Métricas: Performance e Personalização

    • Apresentação
    • Preparando o ambiente
    • Do problema ao indicador
    • Monitoramento de interações na CodeConnect
    • Criando uma métrica customizada
    • Análise de erros no Listin
    • Organizando métricas com tags
    • Utilizando tags para otimizar a análise de feedbacks no Cookin'UP
    • Incorporando a métrica ao acompanhamento
    • Para saber mais: séries temporais no monitoramento
    • Avaliando o impacto de atualizações de software
    • Faça como eu fiz: criar métrica customizada
    • O que aprendemos?
  2. Logs: Estruturação e Visibilidade

    • Quando métricas não são suficientes
    • Monitorando entregas na Hermex Log
    • Explorando logs brutos
    • Identificando problemas de sincronização na Indexa
    • Criando um pipeline de processamento
    • Otimização de logs na plataforma de classificados TRATOTECH
    • Criando atributos e facets
    • Para saber mais: facets e cardinalidade
    • Buscando e analisando erros
    • Analisando problemas de hierarquia na Organo
    • Faça como eu fiz: estruturar logs
    • O que aprendemos?
  3. Investigação: O Poder da Correlação

    • Identificando o incidente
    • Identificando falhas no sistema de pedidos do Serenatto
    • Correlacionando métricas e logs
    • Investigando falhas de compartilhamento na CodeConnect
    • Criando hipóteses
    • Para saber mais: evitando viés de confirmação
    • Analisando atrasos em entregas
    • Aplicando uma estratégia de troubleshooting
    • Melhorando a experiência do cliente no Luz & Cena
    • Resolvendo o caso do curso
    • Investigando falhas em exames laboratoriais
    • Faça como eu fiz: investigar erros
    • O que aprendemos?
  4. Alertas Estratégicos e Notificações

    • Transformando um indicador em monitor
    • Monitoramento de falhas em transações financeiras no SwiftBank
    • Criando um monitor por threshold
    • Gestão de Alertas no SwiftBank
    • Testando e ajustando o monitor
    • Para saber mais: janela de tempo em monitores
    • Ajustando thresholds para alertas de segurança no Bytebank
    • Comparando tipos de monitor
    • Identificação de outliers em dispositivos do HomeHub
    • Criando uma notificação útil
    • Melhorando notificações de alertas para criadores de conteúdo
    • Faça como eu fiz: monitorar API
    • O que aprendemos?
  5. Monitoramento Inteligente com IA

    • O limite dos thresholds fixos
    • Monitoramento de interações na CodeConnect
    • Detectando anomalias
    • Gerenciamento de alertas no e-commerce UseDev
    • Utilizando o Watchdog como apoio
    • Para saber mais: agregação de alertas no datadog
    • Gerenciando alertas no SwiftBank
    • Revisando e reduzindo ruído
    • Ajustando alertas para flutuações em pedidos de produtos pet
    • Faça como eu fiz: alertas com Datadog
    • Conclusão
    • O que aprendemos?

Descubra se esse curso é pra você! Leia as primeiras aulas

Comece essa formação agora mesmo e capacite-se para seu próximo projeto!

Conheça os planos

Faça parte da nossa comunidade no discord!

Troque conhecimentos com a comunidade da Alura

Aprenda Engenharias e Arquiteturas de Dados com esse e outros cursos, comece agora!

Conheça os Planos para Empresas