As oito principais métricas de APM que as equipes de TI usam para monitorar suas aplicações

Publicado 29/08/2023
Atualizado 22/06/2026
Parte de uma nave espacial retrô sobre um fundo de céu azul.
By Jim Holdsworth

Uma experiência do cliente (CX) superior é construída com base em métricas precisas e oportunas de monitoramento de desempenho das aplicações (APM). Se você não souber qual é o problema ou onde estão as oportunidades, não será possível fazer o ajuste fino de seus aplicativos ou sistema para melhorar a experiência do cliente.

As soluções de APM geralmente oferecem um dashboard centralizado para agregar métricas de desempenho e insights em tempo real, a serem analisados e comparados. Elas também estabelecem linhas de base para alertar os administradores de sistema sobre desvios que indicam problemas de desempenho reais ou potenciais. As equipes de TI, o DevOps e os engenheiros de confiabilidade de site podem então identificar e resolver rapidamente os problemas das aplicações.

O monitoramento de desempenho de aplicações é a fase inicial do gerenciamento de desempenho de aplicações. O monitoramento acompanha o desempenho da aplicação e possibilita o gerenciamento dela. Uma solução de APM oferece aos administradores as ferramentas de instrumentação necessárias para coletar dados rapidamente e conduzir a análise de causa raiz; em seguida, eles isolam, diagnosticam e solucionam o problema.

Principais métricas do APM a serem monitoradas

Há uma série de métricas à sua escolha, mas recomendamos o foco nessas oito métricas para aproveitar ao máximo os benefícios em sua organização de TI.

1. Pontuações do Apdex e SLA

Vamos começar com as pontuações do índice de desempenho das aplicações (Apdex) e do contrato de nível de serviço (SLA), pois elas são a base de uma experiência superior do cliente. As velocidades e feeds que você medirá são os aspectos específicos que devem somar para o desempenho rápido, mas são o meio, não o fim. Clientes satisfeitos são seu objetivo, levando ao aumento das vendas.

As pontuações do Apdex e do SLA são a maneira mais popular de visualizar o monitoramento da experiência do usuário final. A pontuação do Apdex rastreia o desempenho relativo de um aplicativo especificando uma meta para o tempo que uma solicitação ou transação da web normalmente leva. Os SLAs são as métricas do seu contrato com o cliente e qualquer coisa abaixo do SLA definido corre o risco de reduzir a experiência do cliente (e possivelmente as penalidades predefinidas).

2. Disponibilidade de aplicações (também conhecida como monitoramento de tempo de atividade ou de desempenho da web)

Esta é a métrica mais básica: as luzes estão acesas? Você está monitorando e medindo se sua aplicação está online e disponível. A maioria das empresas usa isso para medir a conformidade com o contrato de nível de serviço (SLA). O tempo de atividade geralmente é uma abreviação para avaliar a confiabilidade e a integridade geral do sistema. O downtime excessivo pode afetar negativamente a satisfação do usuário nas organizações que oferecem serviços online. Para uma aplicação da web, você pode verificar a disponibilidade com uma verificação HTTP simples e agendada regularmente.

3. Uso da CPU (também conhecido como uso de recursos)

Um alto percentual de capacidade da CPU sendo usada por uma aplicação pode ser um sinal de um problema de desempenho. Um aumento repentino no uso da CPU pode resultar em tempos de resposta mais lentos. As flutuações na demanda por um aplicativo também podem ser uma indicação de que você precisa adicionar mais instâncias da aplicação. Como regra geral, se o uso da CPU exceder 70% por mais de 30% do tempo, você pode estar ficando sem capacidade de CPU.

O uso de recursos também pode incluir o uso de memória e disco. O rastreamento de RAM ajuda a identificar vazamentos de memória que podem levar a falhas ou à necessidade de mais memória. As métricas de uso de disco podem ajudar a evitar que um aplicativo fique sem armazenamento persistente, o que pode causar falhas. O alto uso de discos também pode ser um sinal de armazenamento de dados de back-end ineficiente ou políticas de retenção de dados com falha.

4. Taxas de erros

Seu software de métricas de APM deve monitorar as aplicações para registrar a porcentagem de solicitações que resultam em falhas. Isso ajuda a identificar e priorizar a resolução de problemas que afetam a experiência do usuário. Erros de aplicação podem incluir erros do servidor, uma resposta 404 ou tempo limite em um aplicativo da web. Você pode configurar sua solução APM para enviar notificações quando uma taxa de erro ultrapassar um parâmetro definido. Por exemplo, envie um alerta quando 2,5% das 25 solicitações anteriores tiverem resultado em erros.

5. Coleta de lixo

A coleta de lixo (GC) pode melhorar o desempenho identificando e eliminando o uso pesado de memória contínuo de Java ou outras linguagens. A boa notícia é que a automação de GC recupera a memória dedicada a objetos ou dados não utilizados ou redundantes que não estão mais sendo usados por uma aplicação. Objetos ou dados não utilizados são excluídos e objetos ativos são copiados para um pool de memória de geração posterior. Essa é uma métrica que você deve manter no meio. Se a GC for executado com muita frequência, poderá exigir muita sobrecarga; mas se a GC não for executado com frequência suficiente, seu sistema poderá ficar com pouca memória.

6. Número de instâncias

O rastreamento de instâncias permite que você escale a aplicação para atender à demanda real do usuário, com base em quantas instâncias de aplicativo ou de servidor estão em execução a qualquer momento. Isso pode ser especialmente importante para aplicações na nuvem. O auto-scaling pode ajudar você a garantir que aplicações modernas se dimensionem para atender à demanda e economizar orçamento durante os horários de baixa. Isso também pode criar desafios de monitoramento de infraestrutura. Por exemplo, se o seu aplicativo escalar automaticamente com o uso da CPU, talvez você nunca veja o uso da CPU aumentar — em vez disso, você pode ver o número de instâncias do servidor aumentar muito, junto com sua conta de hospedagem.

7. Taxas de solicitação

Você pode medir o tráfego recebido por uma aplicação para identificar quaisquer reduções, aumentos significativos ou usuários coincidentes. Correlacionar as taxas de solicitação com outras métricas de desempenho das aplicações ajudará você a entender a escalabilidade de suas aplicações de software. O software APM também pode monitorar o tráfego para identificar anomalias. O monitoramento do usuário mostrando um aumento inesperado nas solicitações pode ser um ataque de denial-of-service (DoS). Um grande número de solicitações do mesmo usuário pode ser uma indicação de que a conta foi hackeada. Mesmo as solicitações excepcionalmente baixas podem ser ruins: a inatividade ou a ausência de tráfego pode significar uma falha em praticamente qualquer parte do seu sistema.

8. Tempos de resposta (também conhecidos como duração)

Ao acompanhar o tempo médio de resposta a uma solicitação, ou seja, quanto tempo uma aplicação leva para retornar uma solicitação de recursos, você pode avaliar o desempenho da aplicação. Essas solicitações podem abranger transações iniciadas por usuários finais, como uma solicitação para carregar uma página web, ou incluir solicitações internas de uma parte da sua aplicação para outra, como um processo ou microsserviço que solicita dados do disco ou da memória. O tempo de resposta total inclui o tempo de resposta do servidor (o tempo que o seu servidor leva para processar uma solicitação) mais a latência de rede (o tempo total que a solicitação leva para atravessar a rede).

Uma métrica relacionada é o tempo de carregamento da página, que mede o tempo que uma página da web leva para ser carregada em um navegador. O acompanhamento do tempo de carregamento da página permite que as ferramentas de monitoramento de desempenho das aplicações identifiquem os problemas que causam o carregamento lento de páginas e, em seguida, melhorem a experiência digital. Carregamentos lentos de páginas podem significar abandono de páginas e perda de negócios. As soluções de APM podem ser definidas para uma linha de base de desempenho para essa métrica e, em seguida, alertar você quando esse benchmark não for atingido.

IBM DevOps

O que é DevOps?

Andrea Crawford explica o que é DevOps, seu valor e como suas práticas e ferramentas ajudam você a migrar suas aplicações por todo o pipeline de entrega de software, desde a concepção até a produção. Conduzido pelos principais líderes da IBM, o conteúdo foi concebido para ajudar os líderes empresariais a adquirir o conhecimento necessário para priorizar os investimentos em IA que podem estimular o crescimento.

Métricas adicionais das aplicações

Se você procura um conjunto mais abrangente de métricas relacionadas ao monitoramento de desempenho das aplicações, talvez queira considerar as seguintes métricas:

  • Consultas ao banco de dados: mede o número de consultas solicitadas a um banco de dados por uma aplicação. Suas ferramentas de APM podem, então, ajudar a identificar consultas lentas ou ineficientes que podem estar retardando o desempenho geral de sua aplicação.
  • E/S (entrada/saída): a E/S mostra a taxa com que as aplicações leem ou gravam dados. Você pode acompanhar o desempenho de mídias de armazenamento persistente (como HDD ou SSD) e as taxas de E/S de memória ou discos virtuais.
  • Uso de rede: o uso da rede representa a largura de banda total da rede utilizada por uma aplicação. O aumento do uso da rede pode indicar problemas de desempenho que retardam o tempo de resposta da aplicação ou criam gargalos.
  • Disponibilidade de nós: uma medição semelhante ao número de instâncias é a disponibilidade de nós, mas específica para a nuvem. Quando você implementa aplicações em um cluster Kubernetes, o número de nós disponíveis e que estão respondendo (do total de nós em um cluster) pode ajudar a identificar problemas na sua infraestrutura. As métricas de gastos com a nuvem também podem ser importantes, oferecendo visibilidade em tempo real dos custos de nuvem ao acompanhar as chamadas de API, o tempo de execução de máquinas virtuais (VMs) na nuvem e as taxas totais de saída de dados.
  • Rendimento: rendimento é o volume de dados que pode ser transferido entre um aplicativo e usuários ou outros sistemas. Pode ser usado para determinar se um aplicativo é capaz de lidar com o volume de tráfego esperado.
  • Rastreamento de transações: fornece uma imagem de transações únicas realizadas por uma aplicação. Os dados capturados podem incluir chamadas de banco de dados, chamadas externas e chamadas de função — monitorando a solicitação de transação do início ao fim.
  • Volume de transações: o volume de transações mede o número de transações processadas por uma aplicação. Isso permite que as ferramentas de APM identifiquem problemas com escalabilidade e planejamento de capacidade.

Comece a usar sua solução de APM

O IBM Instana Observability fornece observabilidade em tempo real que todos (e qualquer um) podem usar. Ele oferece time to value rápido, ao mesmo tempo em que garante que sua estratégia de observabilidade possa acompanhar a complexidade dinâmica dos ambientes de hoje e de amanhã. Desde dispositivos móveis até mainframes, o Instana é compatível com mais de 250 tecnologias e continua crescendo.

 

Autora

Jim Holdsworth

Staff Writer

IBM Think

Soluções relacionadas
IBM instana observability

Aproveite o poder da IA e da automação para resolver problemas de forma proativa em todo o stack de aplicações.

Explore o IBM Instana Observability
Soluções de observabilidade da IBM

Maximize a resiliência operacional e garanta a integridade das aplicações nativas da nuvem com a observabilidade impulsionada por IA.

Explore as soluções de observabilidade da IBM
IBM Consulting AIOps

Eleve a automação e as operações de TI com a IA generativa, alinhando todos os aspectos da sua infraestrutura de TI com as prioridades do negócio.

Explore a consultoria de AIOps do IBM Consulting
Dê o próximo passo

Descubra como IBM Instana oferece monitoramento de desempenho de aplicações em tempo real e insights impulsionados por IA, disponíveis como SaaS ou hospedado localmente.

  1. Explore o IBM Instana Observability
  2. Veja em ação