Die 8 wichtigsten APM-Metriken, die IT-Teams zur Überwachung ihrer Apps verwenden

Veröffentlicht 29. August 2023
Aktualisiert 22. Juni 2026
Teil eines Retro-Raumschiffs auf blauem Himmelshintergrund.
By Jim Holdsworth

Eine hervorragende Customer Experience (CX) basiert auf genauen und zeitnahen Metriken zur Überwachung der Anwendungsleistung. Die Feinabstimmung Ihrer Apps oder Systeme zur Verbesserung der CX kann erst gelingen, wenn Sie wissen, wo das Problem oder die Chancen liegen.

APM-Lösungen bieten in der Regel ein zentrales Dashboard, um Leistung Metriken und Erkenntnis in Echtzeit zu aggregieren, zu analysieren und zu vergleichen. Sie legen außerdem Referenzwerte fest, um Systemadministratoren auf Abweichungen aufmerksam zu machen, die auf tatsächliche oder potenzielle Leistung hinweisen. IT-Teams, DevOps-Experten und Site Reliability Engineers können dann Anwendungsprobleme schnell erkennen und beheben.

Die Überwachung der Anwendungsleistung ist die erste Phase des Managements der Anwendungsleistung. Die Überwachung erfasst die Leistung der App und ermöglicht deren Verwaltung. Eine APM-Lösung stellt Administratoren die erforderlichen Überwachungswerkzeuge zur Verfügung, um Daten schnell zu erfassen und Ursachenanalysen durchzuführen; anschließend können sie das Problem eingrenzen, die Fehlerursache ermitteln und das Problem beheben.

Wichtige APM-Metriken zur Überwachung

Es gibt eine Reihe von Metriken, aus denen Sie wählen können, aber wir empfehlen, sich auf diese acht Metriken zu konzentrieren, um den größten Nutzen in Ihrem Unternehmen zu erzielen.

1. Apdex- und SLA-Werte

Beginnen wir mit den Werten des Anwendungsleistungsindex (Apdex) und der Service-Level-Vereinbarung (SLA), da diese die Grundlage für eine hervorragende Customer Experience bilden. Die Geschwindigkeiten und Feeds, die Sie messen, sind die spezifischen Aspekte, die zu einer schnellen Leistung beitragen, aber sie sind das Mittel, nicht das Ziel. Zufriedene Kunden sind Ihr Ziel – und hoffentlich führt das zu höheren Umsätzen.

Apdex- und SLA-Werte sind die beliebteste Methode zur Überwachung der Endbenutzererfahrung. Der Apdex-Score verfolgt die relative Leistung einer App, indem ein Ziel für die Zeit festgelegt wird, die eine Webanforderung oder Transaktion normalerweise in Anspruch nehmen sollte. Die SLAs sind die Metriken in Ihrem Kundenvertrag, und alles, was unter den definierten SLAs liegt, riskiert einen Rückgang der CX (und möglicherweise vordefinierte Strafen).

2. Anwendungsverfügbarkeit (auch bekannt als Betriebszeit oder Leistungsüberwachung)

Dies ist die grundlegendste Metrik: Ist das Licht an? Sie überwachen und messen, ob Ihre Anwendung online und verfügbar ist. Die meisten Unternehmen verwenden dies, um die Einhaltung von Service Level Agreements (SLA) zu messen. Die Betriebszeit ist oft eine Abkürzung für die Bewertung der gesamten Systemzuverlässigkeit und ihres Zustands. Übermäßige Ausfallzeiten können sich negativ auf die Benutzerzufriedenheit von Unternehmen auswirken, die Online-Services bereitstellen. Für Web-Anwendungen können Sie die Verfügbarkeit mit einer einfachen, regelmäßig geplanten HTTP-Prüfung nachvollziehen.

3. CPU-Auslastung (auch bekannt als Ressourcennutzung)

Ein hoher Anteil der von einer Anwendung genutzten CPU-Kapazität kann ein Zeichen für ein Leistungsproblem sein. Ein plötzlicher Anstieg der CPU-Auslastung kann zu langsameren Antwortzeiten führen. Schwankungen in der Nachfrage nach einer App dienen möglicherweise ebenfalls als Hinweis darauf, dass Sie weitere App-Instanzen hinzufügen müssen. Als Faustregel gilt: Wenn die CPU-Auslastung in mehr als 30 % der Fälle 70 % übersteigt, könnte die CPU-Kapazität knapp werden.

Die Ressourcennutzung kann auch die Speicher- und Festplattennutzung umfassen. Die Verfolgung des Arbeitsspeichers hilft bei der Identifizierung von Speicherlecks, die zu einem Ausfall oder zum Bedarf an größerem Speicher führen könnten. Metriken zur Festplattennutzung können verhindern, dass einer App der bestehende Speicherplatz ausgeht, was zu einem Ausfall führen könnte. Eine hohe Festplattenauslastung kann auch ein Zeichen für eine ineffiziente Datenspeicherung oder fehlerhafte Datenaufbewahrungsrichtlinien sein.

4. Fehlerraten

Ihre APM-Metrik-Software sollte Anwendungen überwachen, um den Anteil der Anfragen zu erfassen, die zu Fehlern führen. Dies hilft dabei, Probleme, die sich auf die Benutzerfahrung auswirken, zu identifizieren und zu priorisieren. Anwendungsfehler können Serverfehler, eine 404-Antwort oder eine Zeitüberschreitung in einer Web-App umfassen. Sie können Ihre APM-Lösung so konfigurieren, dass Benachrichtigungen gesendet werden, wenn eine Fehlerrate einen festgelegten Parameter überschreitet. Senden Sie beispielsweise eine Benachrichtigung, wenn 2,5 % der vorherigen 25 Anfragen zu einem Fehler geführt haben.

5. Garbage Collection

Garbage Collection (GC) kann die Leistung verbessern, indem die anhaltende starke Speicherbelegung von Java oder anderen Sprachen identifiziert und beseitigt wird. Die gute Nachricht ist, dass die GC-Automatisierung Speicherplatz zurückgewinnt, der für ungenutzte oder redundante Objekte oder Daten bestimmt ist, die von einer Anwendung nicht mehr verwendet werden. Nicht verwendete Objekte oder Daten werden gelöscht und aktive Objekte in einen Speicherpool einer späteren Generation kopiert. Dies ist eine Metrik, die im guten Mittelfeld gehalten werden sollte. Wenn GC zu oft ausgeführt wird, kann dies zu viel Aufwand erfordern. wird es jedoch nicht oft genug ausgeführt, steht Ihrem System möglicherweise zu wenig Speicherplatz zur Verfügung.

6. Anzahl der Instanzen

Mit der Verfolgung von Instanzen können Sie Ihre Anwendung skalieren, um den tatsächlichen Benutzerbedarf zu erfüllen, basierend darauf, wie viele App- oder Serverinstanzen jeweils ausgeführt werden. Dies kann besonders wichtig für Cloud-Anwendungen sein. Auto-Scaling kann Ihnen dabei helfen, sicherzustellen, dass moderne Anwendungen außerhalb der Spitzenzeiten skaliert werden, um der Nachfrage gerecht zu werden und das Budget zu schonen. Dies kann auch zu Herausforderungen bei der Infrastrukturüberwachung führen. Wenn Ihre App beispielsweise automatisch anhand der CPU-Auslastung nach oben skaliert wird, wird es möglicherweise überhaupt nicht zu einem Anstieg der CPU-Auslastung kommen. Stattdessen könnte es passieren, dass die Anzahl der Serverinstanzen zusammen mit Ihrer Hosting-Rechnung zu weit ansteigt.

7. Anfrageraten

Sie können den von einer Anwendung empfangenen Datenverkehr messen, um alle signifikanten Rückgänge, Zunahmen oder gleichbleibende Benutzer zu identifizieren. Die Korrelation von Anfrageraten mit anderen Leistungsmetriken für die Anwendung hilft Ihnen, die Skalierbarkeit Ihrer Softwareanwendungen zu verstehen. Die APM-Software kann auch den Datenverkehr überwachen, um Anomalien zu erkennen. Die Benutzerüberwachung, die einen unerwarteten Anstieg der Anfragen anzeigt, könnte ein Denial-of-Service-Angriff (DoS) sein. Eine große Anzahl von Anfragen von demselben Benutzer weist möglicherweise auf ein gehacktes Konto hin. Selbst ungewöhnlich niedrige Anfragen sind vielleicht schlecht – Inaktivität oder überhaupt kein Datenverkehr bedeuten mitunter einen Ausfall in Teilen Ihres Systems.

8. Reaktionszeiten (auch als Dauer bezeichnet)

Indem Sie die durchschnittliche Antwortzeit auf eine Anfrage erfassen – also die Zeit, die eine Anwendung benötigt, um eine Anfrage nach Ressourcen zu beantworten –, können Sie die Leistung der Anwendung beurteilen. Diese Anfragen können sowohl von Endnutzern initiierte Vorgänge umfassen, wie beispielsweise die Anforderung, eine Webseite zu laden, als auch interne Anfragen von einem Teil Ihrer Anwendung an einen anderen, wie beispielsweise einen Prozess oder einen Mikroservice, der Daten von der Festplatte oder aus dem Arbeitsspeicher anfordert. Die Gesamtantwortzeit setzt sich aus der Server-Antwortzeit (der Zeit, die Ihr Server zur Bearbeitung einer Anfrage benötigt) und der Netzwerklatenz (der Gesamtzeit, die die Anfrage benötigt, um das Netzwerk zu durchlaufen) zusammen.

Eine verwandte Metrik ist die Seitenladezeit, die die Zeit misst, die eine Webseite zum Laden in einem Browser benötigt. Die Verfolgung der Seitenladezeiten ermöglicht es Ihren Überwachungstools zur Anwendungsleistung, die Probleme zu identifizieren, die zu langsam ladenden Seiten führen, und dann die Digital Experience zu verbessern. Langsame Seitenladevorgänge können zum Abbruch von Seiten und zu Geschäftseinbußen führen. APM-Lösungen werden als Basislinie der Leistung für diese Metrik festgelegt, um Sie dann zu benachrichtigen, wenn dieser Benchmark nicht erreicht wird.

IBM DevOps

Was ist DevOps?

Andrea Crawford erklärt, was DevOps ist, welchen Wert DevOps hat und wie DevOps-Praktiken und -Tools Ihnen dabei helfen, Ihre Anwendungen durch die gesamte Delivery Pipeline der Softwareentwicklung von der Idee bis zur Produktion zu bringen. Das von führenden IBM Experten geleitete Programm soll Führungskräften das nötige Wissen vermitteln, um Prioritäten für KI-Investitionen zu setzen, die zu mehr Wachstum führen.

Zusätzliche Metriken der Anwendung

Wer nach umfassenderen Metriken für die Überwachung der Anwendungsleistung sucht, kann die folgenden in Betracht ziehen:

  • Datenbankabfragen: Messen die Anzahl der Abfragen, die von einer Anwendung bei einer Datenbank angefordert wurden. Ihre APM-Tools können dann dabei helfen, langsame oder ineffiziente Abfragen zu identifizieren, die die Gesamtleistung Ihrer Anwendung beeinträchtigen können.
  • I/O (Eingabe/Ausgabe): I/O zeigt die Rate an, mit der Apps Daten lesen oder schreiben. Man kann die Leistung von persistenten Speichermedien (wie HDD oder SSD) und I/O-Raten für Speicher oder virtuelle Festplatten verfolgen.
  • Netzwerknutzung: Die Netzwerknutzung stellt die gesamte von einer Anwendung genutzte Netzwerkbandbreite dar. Eine erhöhte Netzwerknutzung kann auf Leistungsprobleme hinweisen, die die Reaktionszeit der Anwendung verlangsamen oder Engpässe verursachen.
  • Knotenverfügbarkeit: Ein Kennwert, der der Anzahl der Instanzen ähnelt, ist die Knotenverfügbarkeit; diese ist jedoch spezifisch für die Cloud. Wenn Sie Apps in einem Kubernetes-Cluster bereitstellen, kann die Anzahl der verfügbaren Knoten und die Anzahl der Antworten (aller Knoten in einem Cluster) helfen, Probleme in Ihrer Infrastruktur zu identifizieren. Metriken zu den Cloud-Ausgaben können ebenfalls von Bedeutung sein, da sie Ihnen durch die Erfassung von API-Aufrufen, der Laufzeit cloudbasierter virtueller Maschinen (VMs) und der gesamten ausgehenden Datenraten einen Echtzeit-Überblick über die Cloud-Kosten verschaffen.
  • Durchsatz: Der Durchsatz ist das Datenvolumen, das zwischen einer App und Benutzern oder anderen Systemen übertragen werden kann. Er kann verwendet werden, um festzustellen, ob eine App das erwartete Datenverkehrsaufkommen bewältigen kann.
  • Transaktionsverfolgung: So erhalten Sie einen Überblick über einzelne Transaktionen, die von einer Anwendung ausgeführt werden. Zu den erfassten Daten gehören Datenbankaufrufe, externe Aufrufe und Funktionsaufrufe, sodass die Transaktionsanforderung von Anfang bis Ende überwacht wird.
  • Transaktionsvolumen: Das Transaktionsvolumen misst die Anzahl der Transaktionen, die von einer Anwendung verarbeitet werden. Auf diese Weise können APM-Tools Probleme mit der Skalierbarkeit und Kapazitätsplanung identifizieren.

Erste Schritte bei der Auswahl Ihrer APM-Lösung

IBM Instana Observability bietet Observability in Echtzeit, die wirklich jeder nutzen kann. Es ermöglicht eine rasche Wertschöpfung und stellt sicher, dass Ihre Beobachtbarkeitsstrategie mit der dynamischen Komplexität der heutigen und zukünftigen Umgebungen Schritt halten kann. Von Mobilgeräten bis hin zu Mainframes unterstützt Instana über 250 Technologien, wobei laufend weitere hinzukommen.

 

Autor

Jim Holdsworth

Staff Writer

IBM Think

Verwandte Lösungen Lösungen
IBM Instana Observability

Nutzen Sie die Leistungsfähigkeit von KI und Automatisierung, um Probleme im gesamten Anwendungs-Stack proaktiv zu lösen.

IBM Instana Observability kennenlernen
IBM Observability-Lösungen

Maximieren Sie mit KI-gestützter Observability Ihre betriebliche Ausfallsicherheit und stellen Sie die Integrität Ihrer cloudnativen Anwendungen sicher.

Observability-Lösungen von IBM erkunden
IBM Consulting AIOps

Optimieren Sie die IT-Automatisierung und den IT-Betrieb mit generativer KI und richten Sie jeden Aspekt Ihrer IT-Infrastruktur an den geschäftlichen Prioritäten aus.

Mehr zu IBM Consulting AIOps erfahren
Machen Sie den nächsten Schritt

Entdecken Sie, wie IBM Instana die Leistung von Anwendungen in Echtzeit überwacht und KI-gestützte Erkenntnisse liefert, die als SaaS oder als selbstgehostetes System verfügbar sind.

  1. IBM Instana Observability kennenlernen
  2. Erleben Sie die Lösung in Aktion