Saltar para o conteúdo

Operações modernas

Monitorização e Observabilidade

Monitorizar é acompanhar sinais conhecidos. Observar é conseguir compreender o estado interno de um ambiente a partir dos sinais que ele produz, incluindo situações que não foram antecipadas.

Quatro conceitos distintos

Monitoring

Base
Recolha e apresentação de indicadores conhecidos: disponibilidade de instâncias, estado de work processes, jobs, espaço em disco, utilização de memória. Responde à pergunta «o sistema está dentro dos valores esperados?».

Alerting

Reação
Definição de limiares e regras que geram notificações quando um indicador sai do esperado. O desafio habitual é o equilíbrio: alertas a mais geram ruído, alertas a menos geram silêncio perante problemas reais.

Monitorização centralizada

Escala
Consolidação dos sinais de vários sistemas e camadas num único ponto de consulta, evitando a análise isolada sistema a sistema.

Observability

Compreensão
Capacidade de responder a perguntas novas sobre o comportamento do ambiente, correlacionando diferentes tipos de sinal para localizar onde ocorre um problema, e não apenas constatar que ele existe.

Sinais e dimensões de análise

Os tipos de sinal e as perspetivas que, combinados, sustentam a análise técnica de um ambiente SAP.

Metrics

Valores numéricos ao longo do tempo: utilização, tempos de resposta, filas, contagens.

Logs

Registos textuais de eventos ocorridos, úteis para reconstruir o que aconteceu.

Events

Ocorrências discretas relevantes, como arranques, paragens, alterações e falhas.

Traces

Registo do percurso de um pedido através de componentes, revelando onde o tempo foi consumido.

Availability

O serviço está acessível a quem dele depende?

Performance

O tempo de resposta está dentro do que é aceitável?

Capacity

Os recursos disponíveis suportam a procura atual e prevista?

Correlation

Os sinais das várias camadas contam a mesma história no mesmo instante?

Exemplo conceptual: onde está o problema?

Um utilizador reporta lentidão. Sem correlação entre camadas, a análise depende de tentativa e erro.

  1. Utilizador

    Reporta lentidão numa aplicação

  2. Fiori

    Front-end, launchpad, rede e browser

  3. SAP Application

    Serviço OData, lógica aplicacional

  4. Work Process

    Disponibilidade e tempo de espera

  5. Database

    Execução de instruções, bloqueios, memória

  6. Infrastructure

    CPU, memória, armazenamento, rede

Cadeia típica de um pedido num ambiente SAP moderno.

Se apenas existirem indicadores de infraestrutura, uma lentidão sentida pelo utilizador pode parecer inexistente: o servidor está «verde». Se apenas existirem indicadores aplicacionais, um problema de armazenamento pode aparecer como lentidão inexplicada.

A observabilidade procura resolver esta lacuna ligando os sinais das várias camadas ao mesmo pedido e ao mesmo intervalo de tempo. Assim, é possível distinguir entre espera por work process, tempo de base de dados, latência de rede ou saturação de recursos.

Isto não substitui a monitorização clássica de SAP. Transações de análise, logs do sistema, registos de dumps, bloqueios e updates continuam a ser instrumentos essenciais; a observabilidade organiza e correlaciona esse conhecimento.