Elasticsearch überwachen
Der „ Elasticsearch “-Sensor wird nach der Installation des „ Instana “-Agenten automatisch bereitgestellt und installiert.
Unterstützungsinformationen
Um sicherzustellen, dass der Sensor „ Elasticsearch “ mit Ihrer aktuellen Konfiguration kompatibel ist, lesen Sie bitte die folgenden Abschnitte mit Support-Informationen:
Unterstützte Betriebssysteme
Die vom „ Elasticsearch “-Sensor unterstützten Betriebssysteme entsprechen den Anforderungen des Host-Agenten. Diese können Sie im Abschnitt „Unterstützte Betriebssysteme“ des jeweiligen Host-Agenten nachlesen, beispielsweise unter „Unterstützte Betriebssysteme für Unix “.
Unterstützte Versionen und Support-Richtlinien
Der Sensor unterstützt die Versionen von „ Elasticsearch “ von „ 0.17.0 “ bis „ 8.17.1 “.
Die folgende Tabelle zeigt die aktuellste unterstützte Version und die Support-Richtlinien:
| Technologie | Support-Richtlinie | Neueste Technologieversion | Neueste unterstützte Version |
|---|---|---|---|
| Elasticsearch 8 | 45 Tage | 9.3.3 | 8.19.14 |
Weitere Informationen zur Support-Richtlinie finden Sie unter „Support-Strategie für Sensoren “.
Unterstützung für clientseitiges Tracing
Für diese Technologie unterstützt „ Instana “ die clientseitige Ablaufverfolgung für die folgenden Sprachen und Laufzeiten:
Konfiguration
Instana überwacht automatisch bis zu 1000 Indizes und erfasst die fünf wichtigsten Messwerte pro Index. Um die umfassende Indexüberwachung zu aktivieren, bei der 20 Metriken pro Index für bis zu 200 Indizes erfasst werden, müssen Sie indicesRegex in der Agentenkonfigurationsdatei <agent_install_dir>/etc/instana/configuration.yaml wie folgt angeben:
com.instana.plugin.elasticsearch:
enabled: true
indicesRegex: '<INSERT_INDEX_REGEX_HERE>' # eg. 'env-prod.*'
poll_rate: 1 # values are in seconds. Default value is 1 second.
Konfigurieren der Abfragerate
Sie können festlegen, wie oft „ Instana “ „ Elasticsearch “ abfragt, um Daten und Metriken zu erfassen, indem Sie den poll_rate Parameter in der configuration.yaml Agent-Datei wie im folgenden Beispiel gezeigt verwenden:
com.instana.plugin.elasticsearch:
poll_rate: 1 # values are in seconds. Default value is 1 second.
Messdatenerfassung
Gehen Sie wie folgt vor, um die Metriken anzuzeigen:
- Wählen Sie im Navigationsmenü der Benutzeroberfläche von „ Instana “ die Option „Infrastruktur“ aus.
- Klicken Sie auf einen bestimmten überwachten Host, auf dem Elasticsearch installiert ist.
Sie können das Host-Dashboard mit den folgenden Leistungsmetriken, Konfigurationsdaten und Zustandssignaturen anzeigen.
Knotenebene
Konfigurationsdaten
- Version
- Cluster
- Allgemeinzustand
- Knotenname
- Knotentyp
- Knoten ist Master
- Knoten ist Master-berechtigt
- Transport
- HTTP
- Protokollverzeichnis
- Shards
- Indizes
Leistungsmetriken
| Datenpunkt | Beschreibung | Granularität |
|---|---|---|
| Abfragelatenz | Die Abfragelatenz wird von NodeIndicesStats#SearchStatserfasst. |
1 Sekunde |
| Anzahl der Abfragen | Die Abfrageanzahl pro Sekunde wird aus NodeIndicesStats#SearchStatserfasst. |
1 Sekunde |
| Dokumente (gesamt) | Die Gesamtzahl der Dokumente wird aus DocsStats#counterfasst. |
1 Sekunde |
| Hinzugefügte Dokumente | Die Gesamtzahl der Indexierungsoperationen wird über IndexingStats#indexCount erfasst. |
1 Sekunde |
| Entfernte Dokumente | Die Anzahl der ausgeführten Löschoperationen wird aus IndexingStats#deleteCounterfasst. |
1 Sekunde |
| Aktive Shards | Die Anzahl der aktiven Shards wird über IndexRoutingTable#ShardRouting erfasst. |
1 Sekunde |
| Aktive primäre Shards | Die Anzahl der aktiven primären Shards wird über IndexRoutingTable#ShardRouting erfasst. |
1 Sekunde |
| Aktualisierungsanzahl | Die Anzahl der Aktualisierungen, die pro Sekunde ausgeführt werden, wird aus NodeIndicesStats#RefreshStatserfasst. |
1 Sekunde |
| Aktualisierungszeit | Die Gesamtzeit für Mischvorgänge, die ausgeführt werden, wird aus NodeIndicesStats#RefreshStatserfasst. |
1 Sekunde |
| Flushanzahl | Die Gesamtzahl der pro Sekunde ausgeführten Flushoperationen wird aus NodeIndicesStats#FlushStatserfasst. |
1 Sekunde |
| Flush-Zeit | Die Gesamtzeit für Mischvorgänge, die ausgeführt werden, wird aus NodeIndicesStats#FlushStatserfasst. |
1 Sekunde |
| Indexmessdaten | Die Anzahl der Dokumente, die Anzahl der gelöschten Dokumente und die Größe pro Index werden von IndexStats#DocsStatserfasst. |
1 Sekunde |
| Lucene-Segmente | Die Anzahl der Segmente wird über NodeIndicesStats#SegmentsStats#count erfasst. |
1 Sekunde |
| Aktive Threads | Suche, Index, Massenzuweisung, Zusammenführung, Flush, Abrufen, Management und Aktualisierung werden über ThreadPoolStats.Stats#active erfasst. |
1 Sekunde |
| Threads in der Warteschlange | Suche, Index, Massenzuweisung, Zusammenführung, Flush, Abrufen, Management und Aktualisierung werden über ThreadPoolStats.Stats#queue erfasst. |
1 Sekunde |
| Zurückgewiesene Threads | Suche, Index, Massenzuweisung und Abrufen werden über ThreadPoolStats.Stats#rejected erfasst. |
1 Sekunde |
| Gesendete Daten | Die Größe der vom Knoten während der internen Clusterkommunikation gesendeten TX-Pakete wird von TransportStats#tx_size erfasst. |
1 Sekunde |
| Empfangene Daten | Die Größe der RX-Pakete, die vom Knoten während der internen Clusterkommunikation empfangen werden, wird von TransportStats#rx_size erfasst. |
1 Sekunde |
Indexmessdaten
| Datenpunkt | Beschreibung | Granularität |
|---|---|---|
| Abfragen insgesamt | Die Gesamtzahl der Abfrageoperationen wird über SearchStats.Stats#queryTotal erfasst. |
1 Sekunde |
| Aktuelle Abfragen | Die Anzahl der Abfrageoperationen, die momentan ausgeführt werden, wird von SearchStats.Stats#queryCurrent erfasst |
1 Sekunde |
| Gesamtzahl der Abrufe | Die Gesamtzahl der Abrufoperationen wird über SearchStats.Stats#fetchCount erfasst. |
1 Sekunde |
| Aktuelle Abrufe | Die Anzahl der Abrufoperationen, die momentan ausgeführt werden, wird von SearchStats.Stats#fetchCurrent erfasst |
1 Sekunde |
| Abfragezeit | Die Zeit in Millisekunden, die für die Ausführung von Abfrageoperationen benötigt wird, wird von SearchStats.Stats#queryTimeInMillis erfasst. |
1 Sekunde |
| Abrufzeit | Die Zeit in Millisekunden, die für die Ausführung von Abrufoperationen benötigt wird, wird von SearchStats.Stats#fetchTimeInMillis erfasst. |
1 Sekunde |
| Abfragecachebereinigungen | Die Anzahl der Abfragecachebereinigungen wird über QueryCacheStats#evictions erfasst. |
1 Sekunde |
| Anforderungscachebereinigungen | Die Anzahl der Cachebereinigungsanforderungen wird aus RequestCacheStats#evictions erfasst. |
1 Sekunde |
| GET-Anforderungen | Die Gesamtzahl der Get-Anforderungen wird von GetStats#count erfasst. |
1 Sekunde |
| Zeit für GET-Anforderungen | Die Zeit in Millisekunden, die für GET-Anforderungen verwendet wird, wird über GetStats#timeInMillis erfasst. |
1 Sekunde |
| Fehlgeschlagene Abrufanforderungen | Die Anzahl der fehlgeschlagenen GET-Anforderungen wird über GetStats#missingCount erfasst. |
1 Sekunde |
| Fehlgeschlagene Abrufanforderungen (Zeit) | Die Zeit in Millisekunden, die für fehlgeschlagene Get-Anforderungen aufgewendet wird, wird von GetStats#missingTimeInMillis erfasst |
1 Sekunde |
| Fehlgeschlagene Indexierungsoperationen | Die Anzahl der fehlgeschlagenen Indexierungsoperationen wird aus IndexingStats#indexFailedCount erfasst |
1 Sekunde |
| Anzahl aktiver Zusammenführungen | Die aktuelle Anzahl der ausgeführten Zusammenführungen wird aus MergeStats#current erfasst. |
1 Sekunde |
| Gesamtgröße der Zusammenführungen | Die Gesamtgröße der ausgeführten Zusammenführungen wird aus MergeStats#totalSizeInBytes erfasst. |
1 Sekunde |
| Gesamtzeit der Zusammenführungen | Die Gesamtzeit für ausgeführte Zusammenführungen wird aus MergeStats#totalTimeInMillis erfasst. |
1 Sekunde |
Indexmesswerte, die im Abschnitt "Indexmesswerte" erwähnt werden, sind für Indizes aktiviert, die über einen regulären indicesRegex -Ausdruck in der Agentenkonfiguration konfiguriert werden.
Signaturen für Allgemeinzustand
Jeder Sensor verfügt über eine kuratierte Wissensdatenbank mit Statussignaturen, die kontinuierlich anhand der eingehenden Metriken ausgewertet werden und zum Auslösen von Problemen oder Vorfällen verwendet werden, die von Benutzerauswirkungen abhängen.
Integrierte Ereignisse lösen Probleme oder Vorfälle aus, wenn bei Entitäten Anzeichen für einen Zustand der Instabilität festgestellt werden, während benutzerdefinierte Ereignisse Probleme oder Vorfälle auslösen, wenn die Schwellenwerte einer einzelnen Metrik einer bestimmten Entität überschritten werden.
Weitere Informationen zu erstellten Ereignissen für den Knoten Elasticsearch finden Sie unter Referenz zu integrierten Ereignissen.
Clusterebene
Konfigurationsdaten
- Name
- Allgemeinzustand
- Knoten, Master
Leistungsmetriken
| Datenpunkt | Beschreibung | Granularität |
|---|---|---|
| Abfragelatenz | Die Abfragelatenz wird als maximale Abfragelatenz aller Knoten berechnet. | 1 Sekunde |
| Anzahl der Abfragen | Die Abfrageanzahl wird als Summe der Abfrageanzahl für alle Knoten berechnet. | 1 Sekunde |
| Dokumente (gesamt) | Die Gesamtdokumente werden als Summe der Gesamtdokumente für alle Knoten berechnet. | 1 Sekunde |
| Hinzugefügte Dokumente | Die Summe der Dokumente, die für alle Knoten hinzugefügt werden | 1 Sekunde |
| Entfernte Dokumente | Die Summe der Dokumente, die für alle Knoten entfernt werden | 1 Sekunde |
| Indizes | Die Anzahl der Indizes. | 1 Sekunde |
| Shards | 'Aktiv', 'Aktiv', 'Primär', 'Initialisierung', 'Verlagerung', 'Nicht zugeordnet' werden aus ClusterHealtherfasst. |
1 Sekunde |
| Clusterstatusgröße | Die Größe von ClusterState. |
1 Sekunde |
Signaturen für Allgemeinzustand
Weitere Informationen zu integrierten Ereignissen für den „ Elasticsearch “-Cluster finden Sie in der Referenz zu integrierten Ereignissen.