Elasticsearch überwachen

Der „ Elasticsearch “-Sensor wird nach der Installation des „ Instana “-Agenten automatisch bereitgestellt und installiert.

Hinweis: Der Sensor „ Elasticsearch “ unterstützt keine Überwachung von „ OpenSearch “. Weitere Informationen zur Überwachung des Amazon Web Services (AWS) finden Sie unter „ AWS “ ( OpenSearch, ) unter „Monitoring Amazon OpenSearch Service“.

Unterstützungsinformationen

Um sicherzustellen, dass der Sensor „ Elasticsearch “ mit Ihrer aktuellen Konfiguration kompatibel ist, lesen Sie bitte die folgenden Abschnitte mit Support-Informationen:

Unterstützte Betriebssysteme

Die vom „ Elasticsearch “-Sensor unterstützten Betriebssysteme entsprechen den Anforderungen des Host-Agenten. Diese können Sie im Abschnitt „Unterstützte Betriebssysteme“ des jeweiligen Host-Agenten nachlesen, beispielsweise unter „Unterstützte Betriebssysteme für Unix “.

Unterstützte Versionen und Support-Richtlinien

Der Sensor unterstützt die Versionen von „ Elasticsearch “ von „ 0.17.0 “ bis „ 8.17.1 “.

Die folgende Tabelle zeigt die aktuellste unterstützte Version und die Support-Richtlinien:

Technologie Support-Richtlinie Neueste Technologieversion Neueste unterstützte Version
Elasticsearch 8 45 Tage 9.3.3 8.19.14

Weitere Informationen zur Support-Richtlinie finden Sie unter „Support-Strategie für Sensoren “.

Hinweis: Sicherheitsberechtigungen, die in der Version „ Elasticsearch “ ( 8.17 ) und späteren Versionen eingeführt wurden, können sich auf Instrumentierungen von Drittanbietern auswirken, einschließlich der Anbindung des „ Instana “-Agenten an den „ Elasticsearch “ ( JVM ). Wenn Sie die Überwachung bei diesen Versionen aktivieren, kann es zu Stabilitäts- oder Leistungsproblemen kommen, auch wenn solche Probleme selten sind. Um betroffene Knoten von der Überwachung auszuschließen, verwenden Sie die selektive Überwachung.

Konfiguration

Instana überwacht automatisch bis zu 1000 Indizes und erfasst die fünf wichtigsten Messwerte pro Index. Um die umfassende Indexüberwachung zu aktivieren, bei der 20 Metriken pro Index für bis zu 200 Indizes erfasst werden, müssen Sie indicesRegex in der Agentenkonfigurationsdatei <agent_install_dir>/etc/instana/configuration.yaml wie folgt angeben:

com.instana.plugin.elasticsearch:
  enabled: true
  indicesRegex: '<INSERT_INDEX_REGEX_HERE>' # eg. 'env-prod.*'
  poll_rate: 1 # values are in seconds. Default value is 1 second.
 
Hinweis: Wenn kein bestimmtes Abfrageintervall angegeben wird, beträgt das Standard-Abfrageintervall 1 Sekunde.

Konfigurieren der Abfragerate

Hinweis: Instana Elasticsearch sensor 1.1.79 und spätere Versionen unterstützen die Konfiguration der Abfragerate, um die Datenaufnahme zu reduzieren. Diese Funktion wird auf selbst gehosteten „ Instana “-Backends der Version 311 und höher unterstützt.

Sie können festlegen, wie oft „ Instana “ „ Elasticsearch “ abfragt, um Daten und Metriken zu erfassen, indem Sie den poll_rate Parameter in der configuration.yaml Agent-Datei wie im folgenden Beispiel gezeigt verwenden:

com.instana.plugin.elasticsearch:
  poll_rate: 1 # values are in seconds. Default value is 1 second.
Hinweis: Wenn kein bestimmtes Abfrageintervall angegeben wird, beträgt das Standard-Abfrageintervall 1 Sekunde.

Messdatenerfassung

Gehen Sie wie folgt vor, um die Metriken anzuzeigen:

  • Wählen Sie im Navigationsmenü der Benutzeroberfläche von „ Instana “ die Option „Infrastruktur“ aus.
  • Klicken Sie auf einen bestimmten überwachten Host, auf dem Elasticsearch installiert ist.

Sie können das Host-Dashboard mit den folgenden Leistungsmetriken, Konfigurationsdaten und Zustandssignaturen anzeigen.

Knotenebene

Konfigurationsdaten

  • Version
  • Cluster
  • Allgemeinzustand
  • Knotenname
  • Knotentyp
  • Knoten ist Master
  • Knoten ist Master-berechtigt
  • Transport
  • HTTP
  • Protokollverzeichnis
  • Shards
  • Indizes

Leistungsmetriken

Datenpunkt Beschreibung Granularität
Abfragelatenz Die Abfragelatenz wird von NodeIndicesStats#SearchStatserfasst. 1 Sekunde
Anzahl der Abfragen Die Abfrageanzahl pro Sekunde wird aus NodeIndicesStats#SearchStatserfasst. 1 Sekunde
Dokumente (gesamt) Die Gesamtzahl der Dokumente wird aus DocsStats#counterfasst. 1 Sekunde
Hinzugefügte Dokumente Die Gesamtzahl der Indexierungsoperationen wird über IndexingStats#indexCount erfasst. 1 Sekunde
Entfernte Dokumente Die Anzahl der ausgeführten Löschoperationen wird aus IndexingStats#deleteCounterfasst. 1 Sekunde
Aktive Shards Die Anzahl der aktiven Shards wird über IndexRoutingTable#ShardRouting erfasst. 1 Sekunde
Aktive primäre Shards Die Anzahl der aktiven primären Shards wird über IndexRoutingTable#ShardRouting erfasst. 1 Sekunde
Aktualisierungsanzahl Die Anzahl der Aktualisierungen, die pro Sekunde ausgeführt werden, wird aus NodeIndicesStats#RefreshStatserfasst. 1 Sekunde
Aktualisierungszeit Die Gesamtzeit für Mischvorgänge, die ausgeführt werden, wird aus NodeIndicesStats#RefreshStatserfasst. 1 Sekunde
Flushanzahl Die Gesamtzahl der pro Sekunde ausgeführten Flushoperationen wird aus NodeIndicesStats#FlushStatserfasst. 1 Sekunde
Flush-Zeit Die Gesamtzeit für Mischvorgänge, die ausgeführt werden, wird aus NodeIndicesStats#FlushStatserfasst. 1 Sekunde
Indexmessdaten Die Anzahl der Dokumente, die Anzahl der gelöschten Dokumente und die Größe pro Index werden von IndexStats#DocsStatserfasst. 1 Sekunde
Lucene-Segmente Die Anzahl der Segmente wird über NodeIndicesStats#SegmentsStats#count erfasst. 1 Sekunde
Aktive Threads Suche, Index, Massenzuweisung, Zusammenführung, Flush, Abrufen, Management und Aktualisierung werden über ThreadPoolStats.Stats#active erfasst. 1 Sekunde
Threads in der Warteschlange Suche, Index, Massenzuweisung, Zusammenführung, Flush, Abrufen, Management und Aktualisierung werden über ThreadPoolStats.Stats#queue erfasst. 1 Sekunde
Zurückgewiesene Threads Suche, Index, Massenzuweisung und Abrufen werden über ThreadPoolStats.Stats#rejected erfasst. 1 Sekunde
Gesendete Daten Die Größe der vom Knoten während der internen Clusterkommunikation gesendeten TX-Pakete wird von TransportStats#tx_size erfasst. 1 Sekunde
Empfangene Daten Die Größe der RX-Pakete, die vom Knoten während der internen Clusterkommunikation empfangen werden, wird von TransportStats#rx_size erfasst. 1 Sekunde

Indexmessdaten

Datenpunkt Beschreibung Granularität
Abfragen insgesamt Die Gesamtzahl der Abfrageoperationen wird über SearchStats.Stats#queryTotal erfasst. 1 Sekunde
Aktuelle Abfragen Die Anzahl der Abfrageoperationen, die momentan ausgeführt werden, wird von SearchStats.Stats#queryCurrent erfasst 1 Sekunde
Gesamtzahl der Abrufe Die Gesamtzahl der Abrufoperationen wird über SearchStats.Stats#fetchCount erfasst. 1 Sekunde
Aktuelle Abrufe Die Anzahl der Abrufoperationen, die momentan ausgeführt werden, wird von SearchStats.Stats#fetchCurrent erfasst 1 Sekunde
Abfragezeit Die Zeit in Millisekunden, die für die Ausführung von Abfrageoperationen benötigt wird, wird von SearchStats.Stats#queryTimeInMillis erfasst. 1 Sekunde
Abrufzeit Die Zeit in Millisekunden, die für die Ausführung von Abrufoperationen benötigt wird, wird von SearchStats.Stats#fetchTimeInMillis erfasst. 1 Sekunde
Abfragecachebereinigungen Die Anzahl der Abfragecachebereinigungen wird über QueryCacheStats#evictions erfasst. 1 Sekunde
Anforderungscachebereinigungen Die Anzahl der Cachebereinigungsanforderungen wird aus RequestCacheStats#evictions erfasst. 1 Sekunde
GET-Anforderungen Die Gesamtzahl der Get-Anforderungen wird von GetStats#count erfasst. 1 Sekunde
Zeit für GET-Anforderungen Die Zeit in Millisekunden, die für GET-Anforderungen verwendet wird, wird über GetStats#timeInMillis erfasst. 1 Sekunde
Fehlgeschlagene Abrufanforderungen Die Anzahl der fehlgeschlagenen GET-Anforderungen wird über GetStats#missingCount erfasst. 1 Sekunde
Fehlgeschlagene Abrufanforderungen (Zeit) Die Zeit in Millisekunden, die für fehlgeschlagene Get-Anforderungen aufgewendet wird, wird von GetStats#missingTimeInMillis erfasst 1 Sekunde
Fehlgeschlagene Indexierungsoperationen Die Anzahl der fehlgeschlagenen Indexierungsoperationen wird aus IndexingStats#indexFailedCount erfasst 1 Sekunde
Anzahl aktiver Zusammenführungen Die aktuelle Anzahl der ausgeführten Zusammenführungen wird aus MergeStats#current erfasst. 1 Sekunde
Gesamtgröße der Zusammenführungen Die Gesamtgröße der ausgeführten Zusammenführungen wird aus MergeStats#totalSizeInBytes erfasst. 1 Sekunde
Gesamtzeit der Zusammenführungen Die Gesamtzeit für ausgeführte Zusammenführungen wird aus MergeStats#totalTimeInMillis erfasst. 1 Sekunde

Indexmesswerte, die im Abschnitt "Indexmesswerte" erwähnt werden, sind für Indizes aktiviert, die über einen regulären indicesRegex -Ausdruck in der Agentenkonfiguration konfiguriert werden.

Signaturen für Allgemeinzustand

Jeder Sensor verfügt über eine kuratierte Wissensdatenbank mit Statussignaturen, die kontinuierlich anhand der eingehenden Metriken ausgewertet werden und zum Auslösen von Problemen oder Vorfällen verwendet werden, die von Benutzerauswirkungen abhängen.

Integrierte Ereignisse lösen Probleme oder Vorfälle aus, wenn bei Entitäten Anzeichen für einen Zustand der Instabilität festgestellt werden, während benutzerdefinierte Ereignisse Probleme oder Vorfälle auslösen, wenn die Schwellenwerte einer einzelnen Metrik einer bestimmten Entität überschritten werden.

Weitere Informationen zu erstellten Ereignissen für den Knoten Elasticsearch finden Sie unter Referenz zu integrierten Ereignissen.

Clusterebene

Leistungsmetriken

Datenpunkt Beschreibung Granularität
Abfragelatenz Die Abfragelatenz wird als maximale Abfragelatenz aller Knoten berechnet. 1 Sekunde
Anzahl der Abfragen Die Abfrageanzahl wird als Summe der Abfrageanzahl für alle Knoten berechnet. 1 Sekunde
Dokumente (gesamt) Die Gesamtdokumente werden als Summe der Gesamtdokumente für alle Knoten berechnet. 1 Sekunde
Hinzugefügte Dokumente Die Summe der Dokumente, die für alle Knoten hinzugefügt werden 1 Sekunde
Entfernte Dokumente Die Summe der Dokumente, die für alle Knoten entfernt werden 1 Sekunde
Indizes Die Anzahl der Indizes. 1 Sekunde
Shards 'Aktiv', 'Aktiv', 'Primär', 'Initialisierung', 'Verlagerung', 'Nicht zugeordnet' werden aus ClusterHealtherfasst. 1 Sekunde
Clusterstatusgröße Die Größe von ClusterState. 1 Sekunde