Monitoraggio di un host Solaris
È possibile monitorare il proprio host Solaris con Instana. Instana fornisce informazioni complete sulle prestazioni, lo stato di integrità e l'utilizzo delle risorse dell'host Solaris, consentendo un'efficiente risoluzione dei problemi, l'ottimizzazione delle prestazioni e il rilevamento proattivo dei problemi.
Configurazione della frequenza di polling personalizzata
È possibile configurare la frequenza con cui l' Instana interroga l'host per raccogliere dati e metriche utilizzando il poll_rate parametro nel file <agent_install_dir>/etc/instana/configuration.yaml di configurazione dell'come illustrato nell'esempio seguente:
#Host Sensor Configuration
com.instana.plugin.host:
poll_rate: 1 # values are in seconds. Default value is 1 second. Valid range: 1 to 600 seconds.
Informazioni sul sistema
Instana recupera vari dettagli di sistema da un host. È possibile visualizzare i seguenti dettagli di un host nella GUI di Instana nel riquadro Sistema :
| Parametro | Descrizione |
|---|---|
| Sistemi operativi | I dettagli del sistema operativo. |
| CPU | I dettagli della CPU e il conteggio. |
| Memoria | La quantità di memoria di sistema in gigabyte ( GiB ). |
| Nome Host | Il nome host della macchina. |
| FQDN | Il nome completo del dominio. È il nome di dominio completo dell'host, compreso il sottodominio e il dominio di primo livello. |
| ID sistema* | L'identificatore personalizzato utilizzato da Instana per rappresentare e gestire in modo univoco l'host monitorato all'interno del proprio monitoraggio. System ID viene utilizzato per la correlazione con i sistemi di gestione delle risorse. |
| ID Host | L'indirizzo MAC dell'interfaccia di rete dell'host, che è un identificatore univoco per la scheda di rete. |
| Avviato il | L'ora in cui la macchina è stata avviata. |
*Per Solaris, è necessario abilitare l'ID di sistema utilizzando il file di configurazione dell'agente YAML come mostrato nell'esempio seguente:
"com.instana.plugin.host":
"collectSystemId": true
Interfacce
È possibile trovare i seguenti dettagli:
- Interfacce: l'elenco delle interfacce di rete e degli indirizzi IP.
- Instana agente: L'agente Instana per l'host.
- Processo: il conteggio e i dettagli dei processi in esecuzione sull'host.
Stato reporting
La disponibilità storica di un host Solaris è mostrata nel grafico Stato dei report nella dashboard dell'host Solaris. È possibile visualizzare tre indicatori colorati che identificano lo stato di un host che invia segnalazioni all' Instana.
| Stato | Descrizione | Indicatore di colore |
|---|---|---|
| Creazione di report | L'host ha segnalato a Instana senza alcuna interruzione. | Verde |
| Reporting - Problemi di monitoraggio | L'host ha segnalato ad Instana alcune interruzioni (ad esempio interruzioni di rete o problemi di monitoraggio degli agenti) e non era completamente disponibile. | Arancione |
| Non segnalazione | Durante questo periodo l'host non ha inviato alcun rapporto all' Instana. | Rosso |
La metrica utilizzata per visualizzare questi dati sulla dashboard dell'host si basa sull'aggregazione dei messaggi ricevuti dall'agente che monitora l'host. Un host viene classificato come Reporting se Instana riceve almeno il 98% dei messaggi previsti in un determinato intervallo di tempo.
Ad esempio, se la finestra temporale di aggregazione delle metriche è di 5 minuti e la frequenza di polling dell'host è di una volta al secondo, Instana prevede di ricevere 300 messaggi dall'host durante tale intervallo di tempo.
- Se vengono ricevuti almeno 294 messaggi (il 98% di 300), lo stato dell'host viene visualizzato come Reporting.
- Se vengono ricevuti meno di 294 messaggi ma più di 0, lo stato dell'host viene visualizzato come Segnalazione - Problemi di monitoraggio.
- Se non vengono ricevuti messaggi, lo stato dell'host viene visualizzato come Non segnalato.
Metriche di prestazioni
Per l'host vengono visualizzate le seguenti metriche delle prestazioni.
Utilizzo della CPU - percentuale
I valori di utilizzo della CPU, se combinati, forniscono una visione dettagliata di come vengono utilizzate le risorse della CPU su un host.
| Metrica | Descrizione | Granularità |
|---|---|---|
| Utilizzo CPU | L'utilizzo totale della CPU in percentuale per l'intervallo di tempo impostato. | 1 secondo |
Utilizzo CPU - totale
| Metrica | Descrizione | Granularità |
|---|---|---|
| Utente | La quantità di tempo CPU impiegato per l'esecuzione dei processi dello spazio utente (applicazioni e servizi). | 1 secondo |
| Sistema | La quantità di tempo CPU impiegata per l'esecuzione dei processi dello spazio del kernel (funzioni principali del sistema operativo). | 1 secondo |
| Attesa | Il tempo di CPU impiegato in attesa del completamento delle operazioni di input/output. | 1 secondo |
| Nice | La quantità di tempo CPU impiegata per l'esecuzione di processi con priorità inferiore (valore nice). | 1 secondo |
| Steal | Il tempo di CPU perso quando l'hypervisor gestisce altre macchine virtuali o container sullo stesso host fisico. | 1 secondo |
Carico della CPU - media
La CPU load metrica visualizza il valore su un grafico per un periodo di tempo selezionato.
Punto dati: Filesystem
| Metrica | Descrizione | Granularità |
|---|---|---|
| Carico CPU | Il numero medio di processi eseguiti nell'intervallo di tempo impostato. | 1 secondo |
Carico della CPU - picco
| Metrica | Descrizione | Granularità |
|---|---|---|
| Caricamento | Il carico massimo della CPU. Il numero massimo di processi eseguiti nell'intervallo di tempo impostato. | 1 secondo |
Utilizzo CPU individuale
La CPU usage metrica visualizza le seguenti metriche in percentuale su un grafico per un periodo di tempo selezionato per ciascuna CPU:
| Metrica | Descrizione | Granularità |
|---|---|---|
| Utente | La quantità di tempo CPU impiegato per l'esecuzione dei processi dello spazio utente (applicazioni e servizi). | 1 secondo |
| Sistema | La quantità di tempo CPU impiegata per l'esecuzione dei processi dello spazio del kernel (funzioni principali del sistema operativo). | 1 secondo |
| Attesa | Il tempo di CPU impiegato in attesa del completamento delle operazioni di input/output. | 1 secondo |
| Nice | La quantità di tempo CPU impiegata per l'esecuzione di processi con priorità inferiore (valore nice). | 1 secondo |
| Steal | La quantità di tempo CPU perso a causa dell'hypervisor che gestisce altre macchine virtuali o container sullo stesso host fisico. | 1 secondo |
Punto dati: Filesystem
Utilizzo della memoria
| Metrica | Descrizione | Granularità |
|---|---|---|
| Utilizzo della memoria | Utilizzo totale della memoria in percentuale | 1 secondo |
È possibile misurare il used valore in percentuale utilizzando la formula (total - actualFree) ÷ total. Il sensore utilizza il actualFree valore che è la memoria realmente vincolata che include la memoria libera e quella cache, invece di free, che è un valore basso (utilizzato per il caching o il buffering).
Memoria
La tabella seguente illustra l'unità di misura della memoria:
| Metrica | Unità | Descrizione | Granularità |
|---|---|---|---|
| Utilizzato | Percentuale | Quantità di memoria in uso | 1 secondo |
I valori vengono visualizzati su un grafico per un periodo di tempo selezionato.
Punto dati: Filesystem
File aperti
Utilizzo dei file aperti quando disponibili sul sistema operativo; current vs max. I valori vengono visualizzati su un grafico per un periodo di tempo selezionato. Il sistema operativo Solaris offre un supporto limitato. La zona globale supporta solo la metrica corrente, mentre la zona non globale non supporta alcuna metrica.
| Metrica | Unità | Descrizione | Granularità |
|---|---|---|---|
| Corrente | Byte | La memoria totale disponibile per l'uso da parte del sistema, compresa sia la memoria attiva che quella inattiva. | 1 secondo |
| Utilizzato | Percentuale | La memoria utilizzata dalle applicazioni. | 1 secondo |
Punto dati: Filesystem
File system
Queste metriche forniscono informazioni dettagliate sulle prestazioni, la capacità e l'utilizzo del file system, consentendo agli amministratori di monitorare e ottimizzare in modo efficace i propri sistemi di archiviazione.
| Metrica | Descrizione | Granularità |
|---|---|---|
| Dispositivo | Il nome della periferica. | 60 secondi |
| Montaggi | Posizione di montaggio del file system | 60 secondi |
| Opzioni | Le opzioni o i parametri utilizzati durante il montaggio del file system. | 60 secondi |
| Libero | La quantità di spazio libero disponibile sul file system. | 1 secondo |
| Perduta | Spazio che è stato assegnato ma non utilizzato, considerato "perso" o sprecato. | 1 secondo |
| Letture/s | Il numero di operazioni di lettura al secondo. | 1 secondo |
| Scritture/s | Il numero di operazioni di scrittura al secondo. | 1 secondo |
| Immettere | Il tipo di file system. | 60 secondi |
| Capacità | La capacità totale del file system. | 60 secondi |
| Utilizzato | La quantità di spazio utilizzato sul file system. | 1 secondo |
| Utilizzo inode | La percentuale di inode (strutture dati che descrivono file e directory) in uso. | 1 secondo |
| Byte letti/s | Il numero di byte letti dal file system. | 1 secondo |
| Byte scritti/s | Il numero di byte scritti nel file system. | 1 secondo |
Punto dati: Filesystem
* Le metriche relative all'utilizzo totale, in lettura e in scrittura mostrano l'utilizzo dell'I/O del disco in percentuale.
* Leaked (si riferisce ai file eliminati che sono in uso ed equivale a capacity - used - free. È possibile trovare questi file con lsof | grep deleted).
Per impostazione predefinita, Instana monitora solo i file system locali. È possibile elencare i file system monitorati o esclusi nel configuration.yaml file.
Il nome dell'impostazione di configurazione corrisponde al nome del dispositivo, che è possibile ricavare dalla prima colonna del mnttab file o dall'output df del comando.
L'esempio seguente mostra l'elenco dei file system monitorati:
com.instana.plugin.host:
filesystems:
- 'rpool/export/home'
- 'rpool/VARSHARE'
- 'rpool/ROOT/11.4.90.214.1'
- 'rpool/VARSHARE/sstore'
L'esempio seguente mostra i file system inclusi o esclusi:
com.instana.plugin.host:
filesystems:
include:
- 'rpool/export/home'
- 'rpool/VARSHARE'
exclude:
- 'rpool/ROOT/11.4.90.214.1'
- 'rpool/VARSHARE/sstore'
Interfacce di rete
La tabella seguente illustra il traffico di rete e gli errori per ciascuna interfaccia.
| Metrica | Descrizione | Granularità |
|---|---|---|
| Interfaccia | L'interfaccia di rete utilizzata per la comunicazione. | 60 secondi |
| Mac | L'indirizzo MAC (Media Access Control) dell'interfaccia di rete. | 60 secondi |
| IP | Gli indirizzi IP assegnati all'interfaccia di rete. | 60 secondi |
| Byte RX | Il numero totale di byte ricevuti dall'interfaccia di rete al secondo. | 1 secondo |
| Errori RX | Errori riscontrati durante la ricezione dei dati sull'interfaccia di rete. | 1 secondo |
| Byte TX | Il numero totale di byte trasmessi dall'interfaccia di rete al secondo. | 1 secondo |
| Errori TX | Errori riscontrati durante la trasmissione dei pacchetti sull'interfaccia di rete. | 1 secondo |
| Ricevuti/s | Il numero di pacchetti ricevuti dall'interfaccia di rete al secondo. | 1 secondo |
| Trasmessi/s | Il numero di pacchetti trasmessi dall'interfaccia di rete al secondo. | 1 secondo |
Punto dati: Filesystem
Attività TCP
I seguenti indicatori forniscono informazioni dettagliate sull'attività di connessione dell' TCP, tra cui le connessioni stabilite, le velocità di trasmissione dei segmenti e il numero di errori verificatisi:
| Metrica | Descrizione | Granularità |
|---|---|---|
| Stabilite | Il numero di connessioni stabilite con TCP. | 1 secondo |
| Aperture/s | Il numero di nuove connessioni TCP aperte al secondo. | 1 secondo |
| Segmenti in ingresso/s | Il numero di segmenti in entrata dell' TCP e al secondo. | 1 secondo |
| Segmenti in uscita/s | Il numero di segmenti in uscita dell' TCP e al secondo. | 1 secondo |
| Ripristini stabiliti | Il numero di connessioni stabilite su TCP che sono state interrotte al secondo. | 1 secondo |
| Ripristini in uscita | Il numero di connessioni in uscita TCP che sono state interrotte al secondo. | 1 secondo |
| Non riuscita | Il numero di tentativi falliti di connessione a TCP al secondo. | 1 secondo |
| Errore | Il numero di errori " TCP " al secondo. | 1 secondo |
| Ritrasmissione | Il numero di ritrasmissioni di « TCP » al secondo. | 1 secondo |
Elenco dei principali processi
Queste metriche offrono informazioni dettagliate sui processi in esecuzione, inclusi ID processo, nome, utilizzo della CPU, utilizzo normalizzato della CPU e consumo di memoria. L'elenco dei processi principali viene aggiornato ogni 30 secondi e contiene solo i processi che utilizzano il sistema. Ad esempio, i processi con un utilizzo della CPU superiore al 10% negli ultimi 30 secondi o i processi con un utilizzo della memoria (RSS) superiore a 512 MB vengono visualizzati nell'elenco dei processi principali.
Per creare un elenco combinato dei processi dai primi 10 elenchi di utilizzo della CPU e della memoria, impostare combineTopProcesses su true. I processi sono inclusi nell'elenco combinato anche se il loro utilizzo della CPU è inferiore al 10% o l'utilizzo della memoria è inferiore a 512 MB. Se lo stesso processo è presente sia nell'elenco dei primi 10 processi che consumano più CPU sia in quello dei primi 10 processi che consumano più memoria, verrà elencato una sola volta nell'elenco combinato, che può contenere fino a 20 voci.
com.instana.plugin.host:
combineTopProcesses: true
La CPU normalizzata viene calcolata dividendo la CPU per il numero di processori logici.
| Metrica | Descrizione | Granularità |
|---|---|---|
| PID | L'identificatore univoco assegnato a ciascun processo dal sistema operativo. | 30 secondi |
| Nome processo | Il nome del processo definito dall'applicazione o dal servizio. | 30 secondi |
| CPU | La quantità di risorse CPU consumate dal processo. | 30 secondi |
| CPU (normalizzata) | L'utilizzo della CPU del processo, normalizzato su una scala. | 30 secondi |
| Memoria | La quantità di memoria consumata dal processo. | 30 secondi |
Punto dati: Filesystem
Firme sanitarie
Per ciascun sensore, una base di conoscenze delle firme di integrità viene valutata continuamente rispetto alle metriche in entrata. Sono utilizzati per segnalare problemi o incidenti in base all'impatto sugli utenti.
Gli eventi predefiniti generano problemi o incidenti in base al superamento delle soglie di integrità delle entità, mentre gli eventi personalizzati generano problemi o incidenti in base alle soglie di una singola metrica di un’entità.
Per ulteriori informazioni sugli eventi integrati per il sensore Host, vedere Riferimento agli eventi integrati.