A Relevância do Monitoramento de Aplicações e Infraestrutura
Este documento explora a importância crucial do monitoramento de aplicações e infraestrutura, destacando como essa prática garante a saúde, a escalabilidade e a disponibilidade de sistemas, prevenindo falhas e otimizando o desempenho. Abordaremos os conceitos de NOC, observabilidade e os pilares que a sustentam, além de apresentar ferramentas e exemplos práticos de dashboards de monitoramento.

by João Victor Sousa Valério

Monitoramento: Uma Prática Essencial
A criação de aplicações e infraestruturas geralmente visa a continuidade e a escalabilidade. Para garantir que esses objetivos sejam atingidos, é fundamental ter métricas que forneçam insights sobre a saúde e o desempenho dos sistemas. O monitoramento emerge como uma atividade essencial no ciclo de vida do software, fornecendo feedback valioso sobre o status de diversos aspectos, como logs, erros, nível de uso de componentes da infraestrutura, entre outros.
Através do monitoramento, é possível medir a saúde do software e detectar problemas de desempenho, escalabilidade e disponibilidade de forma preventiva, ou seja, antes que ocorram falhas no sistema. Na área de TI, muitos profissionais já enfrentaram situações de "combate de incêndios", onde falhas, ataques ou problemas inesperados colocaram em risco aplicações ou recursos da infraestrutura.
Prevenindo Tragédias: A Importância do Monitoramento
Embora situações de crise sejam sempre suscetíveis a acontecer, a falta de monitoramento e análise das causas dessas ocorrências revela uma grande vulnerabilidade na organização ou no setor de TI da empresa. Para evitar tais tragédias, existem ferramentas de coleta e monitoramento de dados, facilitando a análise da saúde da infraestrutura e das aplicações.
É importante destacar que a coleta e o monitoramento podem ser realizados desde a construção da aplicação e da infraestrutura, até mesmo após sua implementação e uso contínuo.
NOC: O Centro de Operações de Rede
Para entender melhor o conceito de monitoramento, é crucial conhecer o NOC (Network Operation Center). O NOC é uma equipe de administradores de sistema reunidos para monitorar, gerenciar e controlar um sistema baseado em métricas e ferramentas, atuando como uma equipe SWAT de prontidão para prevenir possíveis ataques.
O foco do NOC é garantir um monitoramento constante e eficaz, utilizando ferramentas como Grafana, NetData, Zabbix, entre outras, para criar dashboards automatizados com dados atualizados instantaneamente. Esses dashboards de produção, com dados coletados de diversas fontes, como bancos de dados (MongoDB e outros), Telegraf, InfluxDB, etc., são configurados para visualizar os dados coletados em painéis agrupados em um dashboard.
Exemplos de Dashboards de Monitoramento
Dashboard NetData
O NetData é uma ferramenta de monitoramento de código aberto que fornece gráficos em tempo real de métricas do sistema, como uso de CPU, memória, disco e rede. O dashboard do NetData exibe informações detalhadas sobre o desempenho do sistema, permitindo identificar rapidamente problemas e tomar medidas corretivas.
Dashboard Grafana
O Grafana é uma plataforma de visualização de dados que permite criar dashboards personalizados para monitorar diversos sistemas e serviços. O dashboard do Grafana pode ser configurado para exibir dados de diferentes fontes, como bancos de dados, sistemas de monitoramento e APIs, proporcionando uma visão abrangente do desempenho do sistema.
Pilares da Observabilidade
1
Métricas (Metrics)
As métricas são objetivos estabelecidos para monitorar se foram alcançados ou não. Elas fornecem informações quantitativas sobre o desempenho do sistema, como o tempo de resposta, a taxa de erros e o uso de recursos.
2
Traços Distribuídos (Distributed Tracing)
O traço distribuído permite investigar uma requisição por todos os sistemas que ela passou, fornecendo uma visão completa do fluxo da requisição e identificando possíveis gargalos de desempenho.
3
Logs
Os logs são registros de acessos ou atividades conforme a regra do negócio ordena que sejam gravados. Eles fornecem informações detalhadas sobre eventos que ocorreram no sistema, como erros, avisos e informações de debug.
Sinais Chaves do Monitoramento e da Observabilidade
É fundamental observar cada aspecto em determinado espaço de tempo para medir e comparar com outros momentos, identificando tendências e padrões de desempenho.
Recursos Adicionais
  • https://cursos.alura.com.br/course/grafana-telegraf-monitoramento
  • https://cursos.alura.com.br/extra/alura-mais/o-que-e-observabilidade--c854
Made with