Monitoring Elasticsearch

在您安裝 Instana 代理程式之後,會自動部署並安裝 Elasticsearch 感應器。

支援的作業系統

Elasticsearch 感應器的受支援作業系統與主機代理程式需求一致,您可以在每一個主機代理程式的「受支援作業系統」區段中檢查這些需求,例如 Unix 的受支援作業系統

支援的版本

Instana 支援監視 Elasticsearch 0.17.0 至 7.17.10的度量及配置資料。

配置

Instana 會自動監視最多 1000 個索引,並每個索引收集 5 個最重要的度量值。 若要啟用深度索引監視 (針對每個索引最多 200 個索引收集 20 個度量) ,您需要在代理程式配置檔 <agent_install_dir>/etc/instana/configuration.yaml中指定 indicesRegex :

com.instana.plugin.elasticsearch:
  enabled: true
  indicesRegex: '<INSERT_INDEX_REGEX_HERE>' # eg. 'env-prod.*'

度量值集合

若要檢視度量值,請在「Instana 使用者」介面的資訊看板中選取 基礎架構 ,按一下特定的受監視主機,然後您可以看到包含所有已收集度量值及受監視處理程序的主機儀表板。

節點層次

配置資料

  • 版本
  • 叢集
  • 性能狀態
  • 節點名稱
  • 節點類型
  • 節點是主要節點
  • 節點是合格的主要節點
  • 傳輸
  • 日誌目錄
  • Shard
  • 索引

效能度量

資料點 說明 精度
Query 延遲時間 NodeIndicesStats#SearchStats收集查詢延遲。 1 秒內
查詢數 每秒查詢計數收集自 NodeIndicesStats#SearchStats 1 秒內
整體文件 DocsStats#count收集文件總數。 1 秒內
已新增的文件 IndexingStats#indexCount收集的檢索作業總數。 1 秒內
已移除文件 IndexingStats#deleteCount收集執行的刪除作業數。 1 秒內
作用中 Shard IndexRoutingTable#ShardRouting收集作用中 Shard 的數目。 1 秒內
作用中主要 Shard IndexRoutingTable#ShardRouting收集作用中主要 Shard 的數目。 1 秒內
重新整理計數 每秒從 NodeIndicesStats#RefreshStats收集執行的重新整理數目。 1 秒內
重新整理時間 已從 NodeIndicesStats#RefreshStats收集執行合併的時間總計。 1 秒內
清除計數 每秒從 NodeIndicesStats#FlushStats收集執行的清除總數。 1 秒內
清除時間 已從 NodeIndicesStats#FlushStats收集執行合併的時間總計。 1 秒內
索引度量 IndexStats#DocsStats收集文件計數、已刪除計數及每個索引的大小。 1 秒內
Lucene 區段 NodeIndicesStats#SegmentsStats#count收集的區段數。 1 秒內
作用中執行緒 ThreadPoolStats.Stats#active收集「搜尋」、「索引」、「大量」、「合併」、「清除」、「取得」、「管理」、「重新整理」。 1 秒內
排入佇列的執行緒 ThreadPoolStats.Stats#queue收集「搜尋」、「索引」、「大量」、「合併」、「清除」、「取得」、「管理」、「重新整理」。 1 秒內
拒絕的執行緒 ThreadPoolStats.Stats#rejected收集「搜尋」、「索引」、「大量」、「取得」。 1 秒內
已傳送的資料 TransportStats#tx_size 收集節點在內部叢集通訊期間所傳送的 TX 封包大小 1 秒內
已接收的資料 TransportStats#rx_size 收集節點在內部叢集通訊期間所接收的 RX 封包大小 1 秒內

索引度量

資料點 說明 精度
查詢總計 SearchStats.Stats#queryTotal 收集的查詢作業總數 1 秒內
查詢(現行) SearchStats.Stats#queryCurrent 收集目前執行的查詢作業數 1 秒內
提取總計 SearchStats.Stats#fetchCount 收集的提取作業總數 1 秒內
提取(現行) SearchStats.Stats#fetchCurrent 收集目前執行中的提取作業數 1 秒內
查詢時間 SearchStats.Stats#queryTimeInMillis 收集執行查詢作業所花費的時間 (毫秒) 1 秒內
提取時間 SearchStats.Stats#fetchTimeInMillis 收集執行提取作業所花費的時間 (毫秒) 1 秒內
查詢快取收回 QueryCacheStats#evictions 收集查詢快取收回的數目 1 秒內
要求快取收回 RequestCacheStats#evictions 收集要求快取收回的數目 1 秒內
Get 要求 GetStats#count 收集 Get 要求總數 1 秒內
Get 要求時間 GetStats#timeInMillis 收集 Get 要求所花費的時間 (毫秒) 1 秒內
失敗的取得要求數 GetStats#missingCount 收集失敗的 Get 要求數 1 秒內
失敗的取得要求時間 GetStats#missingTimeInMillis 收集失敗的 Get 要求所花費的時間 (毫秒) 1 秒內
檢索作業失敗 IndexingStats#indexFailedCount 收集失敗的檢索作業數 1 秒內
作用中合併計數 目前從 MergeStats#current 收集執行的合併數 1 秒內
合併大小總計 MergeStats#totalSizeInBytes 收集執行的合併大小總計 1 秒內
合併時間總計 已從 MergeStats#totalTimeInMillis 收集合併執行的時間總計 1 秒內

上述索引度量將針對代理程式配置中透過正規表示式 indicesRegex 所配置的索引啟用。

性能簽章

每一個感應器都有一個精選的性能簽章知識庫,可以根據送入的度量對性能簽章進行持續評估,並根據使用者影響來觸發問題或發生事件。

內建事件 會根據實體上的性能簽章失敗來觸發問題或突發事件,而 自訂事件 會根據任何給定實體的個別度量值臨界值來觸發問題或突發事件。

如需 Elasticsearch 節點之 built-events 的相關資訊,請參閱 內建事件參照

叢集層次

配置資料

  • 名稱
  • 性能狀態
  • 節點,主要

效能度量

資料點 說明 精度
Query 延遲時間 查詢延遲的計算方式是所有節點的查詢延遲上限。 1 秒內
查詢數 查詢計數計算為所有節點的查詢計數總和。 1 秒內
整體文件 「文件總數」計算為所有節點的整體文件總和。 1 秒內
已新增的文件 「已新增文件」的計算方式為所有節點已新增文件的總和。 1 秒內
已移除文件 「已移除文件」是計算所有節點已移除文件的總和。 1 秒內
索引 索引數 1 秒內
Shard ClusterHealth收集「作用中」、「作用中主要」、「起始設定」、「重新定位」、「取消指派」。 1 秒內
叢集狀態大小 ClusterState的大小。 1 秒內

性能簽章

如需 Elasticsearch 叢集已建置事件的相關資訊,請參閱 內建事件參照