Monitoraggio di un host Solaris

È possibile monitorare il proprio host Solaris con Instana. Instana fornisce informazioni complete sulle prestazioni, lo stato di integrità e l'utilizzo delle risorse dell'host Solaris, consentendo un'efficiente risoluzione dei problemi, l'ottimizzazione delle prestazioni e il rilevamento proattivo dei problemi.

Configurazione della frequenza di polling personalizzata

Nota: i sensori host Instana 1.2.1 e versioni successive supportano la configurazione della frequenza di polling per ridurre l'acquisizione dei dati. Questa funzionalità è supportata sul backend Instana in self-hosting a partire dalla versione 311.

È possibile configurare la frequenza con cui l' Instana interroga l'host per raccogliere dati e metriche utilizzando il poll_rate parametro nel file <agent_install_dir>/etc/instana/configuration.yaml di configurazione dell'come illustrato nell'esempio seguente:

#Host Sensor Configuration
com.instana.plugin.host:
  poll_rate: 1 # values are in seconds. Default value is 1 second. Valid range: 1 to 600 seconds.

Informazioni sul sistema

Instana recupera vari dettagli di sistema da un host. È possibile visualizzare i seguenti dettagli di un host nella GUI di Instana nel riquadro Sistema :

Parametro Descrizione
Sistemi operativi I dettagli del sistema operativo.
CPU I dettagli della CPU e il conteggio.
Memoria La quantità di memoria di sistema in gigabyte ( GiB ).
Nome Host Il nome host della macchina.
FQDN Il nome completo del dominio. È il nome di dominio completo dell'host, compreso il sottodominio e il dominio di primo livello.
ID sistema* L'identificatore personalizzato utilizzato da Instana per rappresentare e gestire in modo univoco l'host monitorato all'interno del proprio monitoraggio. System ID viene utilizzato per la correlazione con i sistemi di gestione delle risorse.
ID Host L'indirizzo MAC dell'interfaccia di rete dell'host, che è un identificatore univoco per la scheda di rete.
Avviato il L'ora in cui la macchina è stata avviata.

*Per Solaris, è necessario abilitare l'ID di sistema utilizzando il file di configurazione dell'agente YAML come mostrato nell'esempio seguente:

"com.instana.plugin.host": 
  "collectSystemId": true
 

Interfacce

È possibile trovare i seguenti dettagli:

  • Interfacce: l'elenco delle interfacce di rete e degli indirizzi IP.
  • Instana agente: L'agente Instana per l'host.
  • Processo: il conteggio e i dettagli dei processi in esecuzione sull'host.

Stato reporting

La disponibilità storica di un host Solaris è mostrata nel grafico Stato dei report nella dashboard dell'host Solaris. È possibile visualizzare tre indicatori colorati che identificano lo stato di un host che invia segnalazioni all' Instana.

Stato Descrizione Indicatore di colore
Creazione di report L'host ha segnalato a Instana senza alcuna interruzione. Verde
Reporting - Problemi di monitoraggio L'host ha segnalato ad Instana alcune interruzioni (ad esempio interruzioni di rete o problemi di monitoraggio degli agenti) e non era completamente disponibile. Arancione
Non segnalazione Durante questo periodo l'host non ha inviato alcun rapporto all' Instana. Rosso

La metrica utilizzata per visualizzare questi dati sulla dashboard dell'host si basa sull'aggregazione dei messaggi ricevuti dall'agente che monitora l'host. Un host viene classificato come Reporting se Instana riceve almeno il 98% dei messaggi previsti in un determinato intervallo di tempo.

Ad esempio, se la finestra temporale di aggregazione delle metriche è di 5 minuti e la frequenza di polling dell'host è di una volta al secondo, Instana prevede di ricevere 300 messaggi dall'host durante tale intervallo di tempo.

  • Se vengono ricevuti almeno 294 messaggi (il 98% di 300), lo stato dell'host viene visualizzato come Reporting.
  • Se vengono ricevuti meno di 294 messaggi ma più di 0, lo stato dell'host viene visualizzato come Segnalazione - Problemi di monitoraggio.
  • Se non vengono ricevuti messaggi, lo stato dell'host viene visualizzato come Non segnalato.

Metriche di prestazioni

Per l'host vengono visualizzate le seguenti metriche delle prestazioni.

Utilizzo della CPU - percentuale

I valori di utilizzo della CPU, se combinati, forniscono una visione dettagliata di come vengono utilizzate le risorse della CPU su un host.

Metrica Descrizione Granularità
Utilizzo CPU L'utilizzo totale della CPU in percentuale per l'intervallo di tempo impostato. 1 secondo

Utilizzo CPU - totale

Metrica Descrizione Granularità
Utente La quantità di tempo CPU impiegato per l'esecuzione dei processi dello spazio utente (applicazioni e servizi). 1 secondo
Sistema La quantità di tempo CPU impiegata per l'esecuzione dei processi dello spazio del kernel (funzioni principali del sistema operativo). 1 secondo
Attesa Il tempo di CPU impiegato in attesa del completamento delle operazioni di input/output. 1 secondo
Nice La quantità di tempo CPU impiegata per l'esecuzione di processi con priorità inferiore (valore nice). 1 secondo
Steal Il tempo di CPU perso quando l'hypervisor gestisce altre macchine virtuali o container sullo stesso host fisico. 1 secondo

Carico della CPU - media

La CPU load metrica visualizza il valore su un grafico per un periodo di tempo selezionato.

Punto dati: Filesystem

Metrica Descrizione Granularità
Carico CPU Il numero medio di processi eseguiti nell'intervallo di tempo impostato. 1 secondo

Carico della CPU - picco

Metrica Descrizione Granularità
Caricamento Il carico massimo della CPU. Il numero massimo di processi eseguiti nell'intervallo di tempo impostato. 1 secondo

Utilizzo CPU individuale

La CPU usage metrica visualizza le seguenti metriche in percentuale su un grafico per un periodo di tempo selezionato per ciascuna CPU:

Metrica Descrizione Granularità
Utente La quantità di tempo CPU impiegato per l'esecuzione dei processi dello spazio utente (applicazioni e servizi). 1 secondo
Sistema La quantità di tempo CPU impiegata per l'esecuzione dei processi dello spazio del kernel (funzioni principali del sistema operativo). 1 secondo
Attesa Il tempo di CPU impiegato in attesa del completamento delle operazioni di input/output. 1 secondo
Nice La quantità di tempo CPU impiegata per l'esecuzione di processi con priorità inferiore (valore nice). 1 secondo
Steal La quantità di tempo CPU perso a causa dell'hypervisor che gestisce altre macchine virtuali o container sullo stesso host fisico. 1 secondo

Punto dati: Filesystem

Utilizzo della memoria

Metrica Descrizione Granularità
Utilizzo della memoria Utilizzo totale della memoria in percentuale 1 secondo

È possibile misurare il used valore in percentuale utilizzando la formula (total - actualFree) ÷ total. Il sensore utilizza il actualFree valore che è la memoria realmente vincolata che include la memoria libera e quella cache, invece di free, che è un valore basso (utilizzato per il caching o il buffering).

Memoria

La tabella seguente illustra l'unità di misura della memoria:

Metrica Unità Descrizione Granularità
Utilizzato Percentuale Quantità di memoria in uso 1 secondo

I valori vengono visualizzati su un grafico per un periodo di tempo selezionato.

Punto dati: Filesystem

File aperti

Utilizzo dei file aperti quando disponibili sul sistema operativo; current vs max. I valori vengono visualizzati su un grafico per un periodo di tempo selezionato. Il sistema operativo Solaris offre un supporto limitato. La zona globale supporta solo la metrica corrente, mentre la zona non globale non supporta alcuna metrica.

Metrica Unità Descrizione Granularità
Corrente Byte La memoria totale disponibile per l'uso da parte del sistema, compresa sia la memoria attiva che quella inattiva. 1 secondo
Utilizzato Percentuale La memoria utilizzata dalle applicazioni. 1 secondo

Punto dati: Filesystem

File system

Queste metriche forniscono informazioni dettagliate sulle prestazioni, la capacità e l'utilizzo del file system, consentendo agli amministratori di monitorare e ottimizzare in modo efficace i propri sistemi di archiviazione.

Metrica Descrizione Granularità
Dispositivo Il nome della periferica. 60 secondi
Montaggi Posizione di montaggio del file system 60 secondi
Opzioni Le opzioni o i parametri utilizzati durante il montaggio del file system. 60 secondi
Libero La quantità di spazio libero disponibile sul file system. 1 secondo
Perduta Spazio che è stato assegnato ma non utilizzato, considerato "perso" o sprecato. 1 secondo
Letture/s Il numero di operazioni di lettura al secondo. 1 secondo
Scritture/s Il numero di operazioni di scrittura al secondo. 1 secondo
Immettere Il tipo di file system. 60 secondi
Capacità La capacità totale del file system. 60 secondi
Utilizzato La quantità di spazio utilizzato sul file system. 1 secondo
Utilizzo inode La percentuale di inode (strutture dati che descrivono file e directory) in uso. 1 secondo
Byte letti/s Il numero di byte letti dal file system. 1 secondo
Byte scritti/s Il numero di byte scritti nel file system. 1 secondo

Punto dati: Filesystem

* Le metriche relative all'utilizzo totale, in lettura e in scrittura mostrano l'utilizzo dell'I/O del disco in percentuale.

* Leaked (si riferisce ai file eliminati che sono in uso ed equivale a capacity - used - free. È possibile trovare questi file con lsof | grep deleted).

Per impostazione predefinita, Instana monitora solo i file system locali. È possibile elencare i file system monitorati o esclusi nel configuration.yaml file.

Il nome dell'impostazione di configurazione corrisponde al nome del dispositivo, che è possibile ricavare dalla prima colonna del mnttab file o dall'output df del comando.

L'esempio seguente mostra l'elenco dei file system monitorati:

com.instana.plugin.host:
  filesystems:
    - 'rpool/export/home'
    - 'rpool/VARSHARE'
    - 'rpool/ROOT/11.4.90.214.1'
    - 'rpool/VARSHARE/sstore'
 

L'esempio seguente mostra i file system inclusi o esclusi:

com.instana.plugin.host:
  filesystems:
    include:
      - 'rpool/export/home'
      - 'rpool/VARSHARE'
    exclude:
      - 'rpool/ROOT/11.4.90.214.1'
      - 'rpool/VARSHARE/sstore'
 

Interfacce di rete

La tabella seguente illustra il traffico di rete e gli errori per ciascuna interfaccia.

Metrica Descrizione Granularità
Interfaccia L'interfaccia di rete utilizzata per la comunicazione. 60 secondi
Mac L'indirizzo MAC (Media Access Control) dell'interfaccia di rete. 60 secondi
IP Gli indirizzi IP assegnati all'interfaccia di rete. 60 secondi
Byte RX Il numero totale di byte ricevuti dall'interfaccia di rete al secondo. 1 secondo
Errori RX Errori riscontrati durante la ricezione dei dati sull'interfaccia di rete. 1 secondo
Byte TX Il numero totale di byte trasmessi dall'interfaccia di rete al secondo. 1 secondo
Errori TX Errori riscontrati durante la trasmissione dei pacchetti sull'interfaccia di rete. 1 secondo
Ricevuti/s Il numero di pacchetti ricevuti dall'interfaccia di rete al secondo. 1 secondo
Trasmessi/s Il numero di pacchetti trasmessi dall'interfaccia di rete al secondo. 1 secondo

Punto dati: Filesystem

Attività TCP

I seguenti indicatori forniscono informazioni dettagliate sull'attività di connessione dell' TCP, tra cui le connessioni stabilite, le velocità di trasmissione dei segmenti e il numero di errori verificatisi:

Metrica Descrizione Granularità
Stabilite Il numero di connessioni stabilite con TCP. 1 secondo
Aperture/s Il numero di nuove connessioni TCP aperte al secondo. 1 secondo
Segmenti in ingresso/s Il numero di segmenti in entrata dell' TCP e al secondo. 1 secondo
Segmenti in uscita/s Il numero di segmenti in uscita dell' TCP e al secondo. 1 secondo
Ripristini stabiliti Il numero di connessioni stabilite su TCP che sono state interrotte al secondo. 1 secondo
Ripristini in uscita Il numero di connessioni in uscita TCP che sono state interrotte al secondo. 1 secondo
Non riuscita Il numero di tentativi falliti di connessione a TCP al secondo. 1 secondo
Errore Il numero di errori " TCP " al secondo. 1 secondo
Ritrasmissione Il numero di ritrasmissioni di « TCP » al secondo. 1 secondo

Elenco dei principali processi

Queste metriche offrono informazioni dettagliate sui processi in esecuzione, inclusi ID processo, nome, utilizzo della CPU, utilizzo normalizzato della CPU e consumo di memoria. L'elenco dei processi principali viene aggiornato ogni 30 secondi e contiene solo i processi che utilizzano il sistema. Ad esempio, i processi con un utilizzo della CPU superiore al 10% negli ultimi 30 secondi o i processi con un utilizzo della memoria (RSS) superiore a 512 MB vengono visualizzati nell'elenco dei processi principali.

Per creare un elenco combinato dei processi dai primi 10 elenchi di utilizzo della CPU e della memoria, impostare combineTopProcesses su true. I processi sono inclusi nell'elenco combinato anche se il loro utilizzo della CPU è inferiore al 10% o l'utilizzo della memoria è inferiore a 512 MB. Se lo stesso processo è presente sia nell'elenco dei primi 10 processi che consumano più CPU sia in quello dei primi 10 processi che consumano più memoria, verrà elencato una sola volta nell'elenco combinato, che può contenere fino a 20 voci.

com.instana.plugin.host:
  combineTopProcesses: true
 

La CPU normalizzata viene calcolata dividendo la CPU per il numero di processori logici.

Metrica Descrizione Granularità
PID L'identificatore univoco assegnato a ciascun processo dal sistema operativo. 30 secondi
Nome processo Il nome del processo definito dall'applicazione o dal servizio. 30 secondi
CPU La quantità di risorse CPU consumate dal processo. 30 secondi
CPU (normalizzata) L'utilizzo della CPU del processo, normalizzato su una scala. 30 secondi
Memoria La quantità di memoria consumata dal processo. 30 secondi

Punto dati: Filesystem

Firme sanitarie

Per ciascun sensore, una base di conoscenze delle firme di integrità viene valutata continuamente rispetto alle metriche in entrata. Sono utilizzati per segnalare problemi o incidenti in base all'impatto sugli utenti.

Gli eventi predefiniti generano problemi o incidenti in base al superamento delle soglie di integrità delle entità, mentre gli eventi personalizzati generano problemi o incidenti in base alle soglie di una singola metrica di un’entità.

Per ulteriori informazioni sugli eventi integrati per il sensore Host, vedere Riferimento agli eventi integrati.