Linux 호스트 모니터링
Linux 호스트는 Instana 에서 모니터링할 수 있습니다. Instana Linux 호스트의 성능, 상태 및 리소스 사용량에 대한 포괄적인 통찰력을 제공하여 효율적인 문제 해결, 성능 최적화 및 사전적 문제 감지를 가능하게 합니다.
사용자 지정 폴링 속도 설정
다음 예시와 같이 에이전트 구성 파일의 <agent_install_dir>/etc/instana/configuration.yaml 매개변수를 poll_rate 사용하여, Instana 가 데이터와 메트릭을 수집하기 위해 호스트를 폴링하는 빈도를 구성할 수 있습니다:
#Host Sensor Configuration
com.instana.plugin.host:
poll_rate: 1 # values are in seconds. Default value is 1 second. Valid range: 1 to 600 seconds.
시스템 정보
Instana Linux 호스트에서 포괄적인 시스템 정보를 자동으로 수집합니다. Instana 대시보드의 시스템 창에서 다음 세부 정보를 확인하세요:
| 매개변수 | 설명 |
|---|---|
| OS | 운영 체제 세부 정보(커널 버전 및 아키텍처 포함). |
| CPU | CPU 모델 및 코어 수. |
| 메모리 | GiB 의 총 시스템 메모리(기비바이트). |
| 최대 열린 파일 | 시스템이 지원하는 동시 파일 작업의 최대 수. |
| 호스트 이름 | Linux 호스트의 네트워크 호스트 이름. |
| FQDN | 완전한 도메인 이름(FQDN), 하위 도메인과 최상위 도메인을 포함함. |
| 머신 ID | Linux 배포 설치 과정에서 생성된 고유 식별자. |
| 부트 ID | 현재 부팅 세션의 고유 식별자. |
| 시스템 ID | Instana 에서 호스트 관리 및 자산 관리 시스템과의 연계에 사용되는 사용자 지정 식별자. Instana 에 의해 Linux 운영 체제용 에이전트가 자동으로 수집한 정보입니다. |
| 호스트 ID | 기본 네트워크 인터페이스의 MAC 주소. |
| 시작 시간 | 시스템 부팅 타임스탬프. |
| BIOS 버전 | 시스템 BIOS(기본 입출력 시스템) 또는 UEFI(통합 확장 펌웨어 인터페이스) 펌웨어의 버전 번호. |
| BIOS 릴리스 날짜 | 설치된 BIOS 버전의 출시일. |
| OS 공급업체 이름 | 운영 체제를 제공한 조직 또는 배포판의 이름. |
| OS 공급업체 ID | 프로그램 방식의 OS 공급업체 식별을 위한 짧은 식별자. |
| 하드웨어 모델 | 시스템 또는 시스템 보드의 특정 모델명 또는 번호. |
| 하드웨어 상표 | 하드웨어 제조업체명. |
/sys/class/dmi/id/ /dev/devdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdevdev 이 데이터는 시스템 펌웨어에서 제공하는 DMI(데스크톱 관리 인터페이스) 및 SMBIOS(시스템 관리 BIOS)에서 가져온 것입니다.인터페이스
다음과 같은 세부 정보를 확인할 수 있습니다:
- 인터페이스: 네트워크 인터페이스 및 IP 주소 목록.
- Instana 에이전트: 호스트의 Instana 에이전트.
- 프로세스: 호스트에서 실행 중인 프로세스의 개수와 세부 정보.
보고 상태
Linux 호스트의 과거 가용성은 Linux 호스트 대시보드의 '보고 상태' 차트에 표시됩니다. Instana 에 보고하는 호스트의 상태를 나타내는 세 가지 색상 표시기를 확인할 수 있습니다.
| 상태 | 설명 | 색상 표시기 |
|---|---|---|
| 보고 | 호스트는 중단 없이 Instana 에 보고했습니다. | 그린 |
| 보고 - 모니터링 문제 | 호스트가 Instana 에 일부 중단(예: 네트워크 중단 또는 에이전트 모니터링 문제)이 발생하여 완전히 가용하지 않았습니다. | 주황색 |
| 보고하지 않음 | 해당 호스트는 이 기간 동안 Instana 에 전혀 보고하지 않았습니다. | 빨간색 |
호스트 대시보드에 이 데이터를 표시하는 데 사용되는 메트릭은 호스트를 모니터링하는 에이전트로부터 수신된 메시지의 집계를 기반으로 합니다. 호스트는 특정 기간 동안 예상 메시지의 98% 이상을 Instana 이 수신할 경우 보고 호스트로 분류됩니다.
예를 들어, 메트릭 집계 시간 창이 5분이고 호스트의 폴링 빈도가 초당 1회인 경우, Instana 은 해당 시간 동안 호스트로부터 300개의 메시지를 수신할 것으로 예상합니다.
- 최소 294개의 메시지(300개의 98%)가 수신되면 호스트 상태가 '보고 중'으로 표시됩니다.
- 수신된 메시지가 294개 미만이지만 0개보다 큰 경우, 호스트 상태는 '보고 중 – 모니터링 문제 발생'으로 표시됩니다.
- 메시지를 수신하지 못할 경우, 호스트 상태는 보고 중지됨 으로 표시됩니다.
성능 매트릭
Linux 호스트에 대해 다음 성능 지표가 표시됩니다.
CPU 사용률: 전체
CPU 사용량 값들은 결합될 때, Linux 호스트에서 CPU 리소스가 어떻게 활용되고 있는지에 대한 상세한 정보를 제공합니다.
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| CPU 사용량 | 설정한 시간 범위에 대한 총 CPU 사용률(퍼센트). | 1초 |
메모리 사용량: 전체
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 메모리 사용량 | 전체 메모리 사용량(퍼센트) | 1초 |
공식을 사용하여 백분율로 값을 used(total - actualFree) ÷ total 측정할 수 있습니다. 센서는 낮은 값(캐싱 또는 버퍼링에 사용됨)인 대신 free, 사용 가능한 actualFree 메모리와 캐시된 메모리를 포함하는 실제 제한 메모리 값을 사용합니다.
CPU 부하: 최대
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 로드 | 최대 CPU 부하. 설정한 시간 범위 내에서 실행된 프로세스의 최대 개수. | 1초 |
프로세스 차단 상태
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 프로세스 차단 상태 | I/O 리소스가 사용 가능해지기를 기다리는 차단 상태의 프로세스 수. | 1분 |
프로세스 대기 런타임
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 프로세스 대기 런타임 | CPU 시간을 기다리며 실행 대기열에 있는 프로세스 수. | 1분 |
사용자 세션
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 사용자 세션 | 호스트에서 동시에 로그인된 사용자 세션 수. | 1분 |
CPU 사용률: 총합
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 사용자 | 응용 프로그램 및 사용자가 시작한 서비스를 포함한 사용자 공간 프로세스 실행에 소요되는 CPU 시간의 비율. | 1초 |
| 시스템 | 커널 작업(시스템 호출, 장치 드라이버 및 핵심 OS 기능 포함) 실행에 소요되는 CPU 시간의 비율. | 1초 |
| 대기 | I/O 작업 완료를 기다리는 데 소요되는 CPU 시간의 비율로, 잠재적인 디스크 또는 네트워크 병목 현상을 나타냅니다. | 1초 |
| 양호 | 우선순위가 낮아진 프로세스(양의 nice 값)를 실행하는 데 소요되는 CPU 시간의 비율로, 이로 인해 우선순위가 더 높은 작업이 먼저 실행될 수 있습니다. | 1초 |
| 스틸 | 하이퍼바이저가 동일한 물리적 호스트에서 다른 가상 머신을 서비스하기 위해 빼앗는 CPU 시간의 비율. | 1초 |
| 유휴 | 프로세서가 유휴 상태였으며 I/O 작업을 기다리지 않았던 CPU 시간의 비율로, 사용 가능한 CPU 용량을 나타냅니다. | 1초 |
컨텍스트 전환
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 컨텍스트 전환 | 선택된 시간 구간 동안 그래프에서 발생한 컨텍스트 전환의 총 횟수. | 1초 |
CPU 부하: 평균
이 CPU load 메트릭은 CPU 리소스를 놓고 경쟁하는 프로세스의 평균 개수를 추적하며, 시계열 그래프로 표시됩니다.
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| CPU 로드 | 선택한 시간 동안 실행 대기열(CPU에서 실행 중이거나 CPU 시간을 대기 중인)에 있는 프로세스의 평균 개수로, 시스템 작업 부하와 리소스 수요에 대한 통찰력을 제공합니다. | 1초 |
개별 CPU 사용량
CPU 사용률 지표는 선택한 기간 동안 각 CPU에 대해 그래프 상에 백분율로 다음 지표를 표시합니다:
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 사용자 | 사용자 공간 프로세스(애플리케이션 및 서비스) 실행에 소요되는 CPU 시간의 양. | 1초 |
| 시스템 | 커널 공간 프로세스(OS 핵심 기능) 실행에 소요되는 CPU 시간의 양. | 1초 |
| 대기 | 입력 또는 출력 작업이 완료되기를 기다리는 데 소요되는 CPU 시간의 양. | 1초 |
| 양호 | 낮은 우선순위(nice 값)를 가진 프로세스를 실행하는 데 소요되는 CPU 시간의 양. | 1초 |
| 스틸 | 하이퍼바이저가 동일한 물리적 호스트에서 다른 가상 머신이나 컨테이너를 관리하는 데 소모되는 CPU 시간의 양. | 1초 |
| 유휴 | 프로세서가 유휴 상태였던 CPU 시간의 비율. | 1초 |
개별 GPU 사용량
다음 표는 값들을 Individual GPU usage 요약합니다:
| 메트릭 | 설명 | 세분성 | 단위 |
|---|---|---|---|
| GPU 사용량 | GPU 사용률 | 1초 | % |
| 온도 | GPU 온도 (섭씨) | 1초 | °C |
| 인코더 | 인코더 활용도 | 1초 | % |
| 디코더 | 디코더 활용도 | 1초 | % |
| 사용된 메모리 | 메모리 사용량 | 1초 | % |
| 메모리 총계 | 총 GPU 메모리 | 1초 | 바이트 |
| 전송된 처리량 | 전송 데이터 속도 | 1초 | 바이트/초 |
| 수신 처리량 | 받은 데이터 전송률 | 1초 | 바이트/초 |
해당 지표는 에서 수집됩니다 nvidia-smi. 다음 표는 지원되는 Nvidia 그래픽 카드 버전을 요약합니다:
| 브랜드 | 모델 |
|---|---|
| Tesla | S1070, S2050, C1060, C2050/70, M2050/70/90, X2070/90, K10, K20, K20X, K40, K80, M40, P40, P100, V100 |
| Quadro | 4000, 5000, 6000, 7000, M2070-Q, K 시리즈, M 시리즈, P 시리즈, RTX 시리즈 |
| GeForce | 테슬라와 Quadro 제품보다 더 적은 수의 메트릭을 갖는 다양한 수준의 지원 |
전제조건
최신 공식 NVIDIA 드라이버를 설치해야 합니다.
GPU 지원이 포함된 Instana 에이전트용 Docker 컨테이너 시작에 대한 자세한 내용은 Instana 에이전트 컨테이너를 통한 GPU 모니터링 활성화를 참조하십시오.
GPU 메트릭 데이터 수집은 폴링과 쿼리를 두 프로세스로 분리하여 최소한의 nvidia-smi영향으로 설계되었습니다. 백그라운드 프로세스는 루프 모드로 시작되어 메모리에 유지됩니다. 이 프로세스는 메트릭 수집 성능을 크게 향상시키고 잠재적인 오버헤드를 방지합니다.
센서는 구성된 폴링 속도(기본값: 초당 1회)에 따라 GPU 메트릭을 조회합니다. 이 솔루션은 오버헤드 없이 여러 GPU에 대해 매초마다 정확하고 최신 상태의 메트릭을 센서가 수집할 수 있도록 합니다.
GPU 메모리/프로세스
다음 프로세스 목록은 GPU를 사용합니다:
| 데이터 점 | 수집 대상 | 세분성 |
|---|---|---|
Process Name |
nvidia-smi |
1초 |
PID |
nvidia-smi |
1초 |
GPU |
nvidia-smi |
1초 |
Memory |
nvidia-smi |
1초 |
다음 표는 GPU 메모리를 위한 NVIDIA 그래픽 카드의 지원 버전을 요약합니다:
| 브랜드 | 모델 |
|---|---|
| Tesla | S1070, S2050, C1060, C2050/70, M2050/70/90, X2070/90, K10, K20, K20X, K40, K80, M40, P40, P100, V100 |
| Quadro | 4000, 5000, 6000, 7000, M2070-Q, K 시리즈, M 시리즈, P 시리즈, RTX 시리즈 |
| GeForce | 테슬라와 Quadro 제품보다 더 적은 수의 메트릭을 갖는 다양한 수준의 지원 |
메모리
다음 표는 메모리의 단위를 요약합니다:
| 메트릭 | 단위 | 설명 | 세분성 |
|---|---|---|---|
| 총계 | 바이트 | 메모리 총 용량 | 1초 |
| 공유 | 바이트 | Linux 시스템에서 공유 메모리 세그먼트와 tmpfs 파일 시스템이 사용하는 메모리 | 1초 |
| 사용된 | 백분율 | 사용 중인 메모리 양 | 1초 |
| 버퍼 | 바이트 | 버퍼에 사용된 메모리 | 1초 |
| 캐시됨 | 바이트 | 캐싱에 사용되는 메모리 | 1초 |
| 사용 가능 | 바이트 | 사용 가능한 메모리 | 1초 |
| 스왑 총계 | 바이트 | 사용 가능한 전체 스왑 공간 | 1초 |
| 스왑 사용 가능 | 바이트 | 사용 가능 스왑 공간 | 1초 |
| 스왑 사용 | 백분율 | 사용 중인 스왑 공간의 양 | 1초 |
| 가상 총계 | 바이트 | 가상 메모리의 총 용량(물리 메모리 및 스왑 공간). | 1초 |
| 사용된 가상 | 바이트 | 회수 가능한 버퍼와 캐시를 제외한, 애플리케이션이 적극적으로 사용하는 메모리 | 1초 |
| 사용 가능한 가상 | 바이트 | 할당 가능한 가상 메모리의 양. | 1초 |
선택한 기간 동안의 값이 그래프에 표시됩니다.
페이징 활동
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 총 결함 수 | 프로세스가 RAM에 없는 메모리에 접근할 때 발생하는 마이너 및 메이저 페이지 오류의 총 수. | 1초 |
| 주요 결함 수 | 메모리에 데이터를 디스크에서 불러와야 하는 주요 페이지 오류의 수. | 1초 |
| 페이지 인됨 | 디스크에서 물리적 RAM으로 전송되는 메모리 페이지의 수. | 1초 |
| 페이지 아웃됨 | 물리적 RAM에서 디스크로 전송되는 메모리 페이지의 수. | 1초 |
| 스왑 인됨 | 디스크의 스왑 공간에서 물리적 RAM으로 다시 전송되는 메모리 페이지의 수. | 1초 |
| 스왑 아웃됨 | 물리적 RAM에서 디스크의 스왑 공간으로 전송되는 메모리 페이지의 수. | 1초 |
기본적으로 페이징 활동 메트릭은 수집되지 않습니다. 파일에서 configuration.yaml 를 collectPagingActivity 로 true 설정하면 페이징 활동 메트릭 수집을 활성화할 수 있습니다.
com.instana.plugin.host:
collectPagingActivity: true # [true, false]
파일 열기
운영체제에서 사용 가능한 경우 파일 사용량 열기; current vs max. 선택한 기간 동안의 값이 그래프에 표시됩니다.
| 메트릭 | 단위 | 설명 | 세분성 |
|---|---|---|---|
| 현재 | 바이트 | 시스템이 사용할 수 있는 총 메모리 용량으로, 활성 메모리와 비활성 메모리를 모두 포함합니다. | 1초 |
| 사용된 | 백분율 | 프로세스가 사용 중인 메모리. | 1초 |
프로세스 통계량
기본적으로 프로세스 통계 메트릭은 수집되지 않습니다. 에이전트 configuration.yaml 파일에서 를 collectSystemProcess 로 true 설정하면 프로세스 통계 지표 수집을 활성화할 수 있습니다.
com.instana.plugin.host:
collectSystemProcess: true # [true, false]
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 총 프로세스 수 | 시스템에서 현재 실행 중인 프로세스의 총 개수. 여기에는 활성 프로세스, 대기 중인 프로세스, 중지된 프로세스 및 좀비 프로세스가 모두 포함됩니다. | 1분 |
| 차단 상태 | 디스크 읽기, 네트워크 응답 또는 기타 리소스 가용성과 같은 I/O 작업 완료를 기다리는 차단 상태의 프로세스 수. | 1분 |
| 대기 실행 시간 | 런 큐에서 CPU 시간 할당을 기다리는 프로세스 수로, 실행 준비가 되었으나 현재 CPU에서 실행되지 않는 프로세스를 나타냅니다. | 1분 |
| 좀비 | 실행은 완료되었으나 프로세스 테이블에 여전히 항목이 남아 부모 프로세스가 상태를 읽기를 기다리는 좀비 프로세스의 수. | 1분 |
좀비 프로세스
좀비 프로세스는 종료 상태가 아직 부모 프로세스에 의해 수집되지 않은 실행 중인 프로세스입니다. 이러한 프로세스는 CPU나 메모리를 소비하지 않습니다.
좀비 프로세스는 대시보드에 다음과 같은 세부 정보와 함께 목록으로 표시됩니다:
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| PID | 좀비 프로세스의 프로세스 ID. | 1분 |
| PPID | 상위 프로세스의 프로세스 ID | 1분 |
| 사용자 | 좀비 프로세스의 소유자 사용자. | 1분 |
| 상태 | 좀비 프로세스의 현재 상태. | 1분 |
| 시작 시간 | 좀비 프로세스가 시작된 시간 또는 날짜. | 1분 |
| CPU 시간 | 좀비 프로세스가 소비한 총 CPU 시간. | 1분 |
| 우선순위 | 프로세스에 할당된 스케줄링 우선순위(값이 낮을수록 우선순위가 높음). | 1분 |
RPC 클라이언트 및 서버 활동
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 클라이언트 호출 | 클라이언트가 원격 서버로 시작하는 RPC 호출의 수. | 1분 |
| 재전송된 호출 | 타임아웃 또는 네트워크 문제로 인해 재전송된 RPC 호출의 수. | 1분 |
| 인증이 새로 고침됨 | RPC 작업 중 클라이언트가 인증 자격 증명을 새로 고친 횟수. | 1분 |
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 서버 호출 수 | 서버가 수신하고 처리한 RPC 호출의 수. | 1분 |
| 거절된 호출 수 | 서버에서 다양한 이유로 거부된 RPC 호출의 수. | 1분 |
| 인증 실패 | 인증 검증을 실패한 RPC 호출의 수. | 1분 |
| 패킷의 잘못된 헤더 | 잘못된 형식이나 손상된 헤더를 가진 RPC 패킷의 수. | 1분 |
| 올바르지 않은 요청 수 | RPC 요청 중 유효하지 않거나 형식이 잘못된 요청의 수. | 1분 |
기본적으로 RPC 클라이언트 및 서버 활동 메트릭은 수집되지 않습니다. 에이전트 configuration.yaml 파일에서 를 collectRpcActivity 로 true 설정하면 RPC 활동 메트릭 수집을 활성화할 수 있습니다.
com.instana.plugin.host:
collectRpcActivity: true # [true, false]
파일 시스템
이러한 지표는 파일 시스템의 성능, 용량 및 사용 현황에 대한 통찰력을 제공하여 관리자가 스토리지 시스템을 효과적으로 모니터링하고 최적화할 수 있도록 합니다.
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 디스크 여유 공간 | 파일 시스템에서 사용 가능한 여유 공간의 양. | 1초 |
| 누락 | 할당되었으나 사용되지 않은 공간으로, 누수되거나 낭비된 것으로 간주됩니다. | 1초 |
| 용량 | 파일 시스템의 총 용량. | 1초 |
| 사용된 디스크 비율 | 파일 시스템에서 사용 중인 공간의 비율. | 1초 |
| Inode 사용 | 사용 중인 inode(파일 및 디렉터리를 설명하는 데이터 구조)의 비율. | 1초 |
| Inode 사용 가능 | 파일 시스템에서 사용 가능한 자유 인오드(inode)의 수. | 1초 |
| 읽은 바이트 수/초 | 읽기 작업의 활용. | 1초 |
| 기록된 바이트/초 | 쓰기 작업의 활용. | 1초 |
| 읽기/초 | 파일 시스템에서 읽은 바이트 수. | 1초 |
| 쓰기/초 | 파일 시스템에 기록된 바이트 수. | 1초 |
| 읽기 이용률 | 읽기 작업을 수행하는 데 소요되는 시간의 비율. | 1초 |
| 쓰기 이용률 | 쓰기 작업을 수행하는 데 소요되는 시간의 비율. | 1초 |
| 총 이용률 | 읽기, 쓰기 및 inode 사용량을 합산한 파일 시스템의 전체 사용량. | 1초 |
| 태그 | 설명 |
|---|---|
| 디바이스 | 디바이스의 이름. |
| 마운트 | 파일 시스템 계층 구조에서 장치가 마운트되는 마운트 지점. |
| 옵션 | 파일 시스템을 마운트할 때 사용되는 옵션 또는 매개변수. |
| 유형 | 파일 시스템의 유형. |
* 총 사용량, 읽기 사용량 및 쓰기 사용량 데이터 포인트 메트릭은 디스크 I/O 사용률을 백분율로 표시합니다.
* Leaked (사용 중인 삭제된 파일을 가리키며,. capacity - used - free에 해당합니다.) 이 파일들은 ( ) lsof | grep deleted로 찾을 수 있습니다.
**, Read Utilization, 및 Write Utilization 데이터 Total Utilization 포인트는 네트워크 파일 시스템( NFS )에서 지원되지 않습니다.
기본적으로 Instana 은 로컬 파일 시스템만 모니터링합니다. 해당 configuration.yaml 파일에서 모니터링 대상 또는 제외 대상인 파일 시스템을 나열할 수 있습니다.
구성 설정의 이름은 장치 이름이며, 이는 파일의 mtab 첫 번째 열 또는 df 명령어 출력에서 확인할 수 있습니다.
임시 파일 시스템은 다음 형식으로 지정해야 합니다: tmpfs:/mount/point.
다음 예시는 모니터링되는 파일 시스템 목록을 보여줍니다:
com.instana.plugin.host:
filesystems:
- '/dev/sda1'
- 'tmpfs:/sys/fs/cgroup'
- 'server:/usr/local/pub'
다음 예시는 포함되거나 제외되는 파일 시스템을 보여줍니다:
com.instana.plugin.host:
filesystems:
include:
- '/dev/xvdd'
- 'tmpfs:/tmp'
- 'server:/usr/local/pub'
exclude:
- '/dev/xvda2'
네트워크 파일 시스템 ( NFS )
모든 NFS 을 모니터링하려면 다음 예시와 같이 구성 nfs_all: true 매개변수를 사용하십시오:
com.instana.plugin.host:
nfs_all: true
디스크
다음 표는 디스크와 관련된 지표를 다룹니다
| 메트릭 | 설명 | 세분성 | 단위 |
|---|---|---|---|
| 디바이스 | 디스크 또는 파티션의 이름. | 1초 | 밀리초 |
| 읽기 시간 | 읽기 요청이 완료되는 데 걸리는 평균 시간. | 1초 | 밀리초 |
| 쓰기 시간 | 쓰기 요청이 완료되는 데 걸리는 평균 시간. | 1초 | 밀리초 |
| 요청 취소 시간 | 폐기 요청이 완료되는 데 걸리는 평균 시간. | 1초 | 밀리초 |
| 요청 비우기 시간 | 플러시 요청이 완료되는 데 걸리는 평균 시간. | 1초 | 밀리초 |
| 바이트 읽기 비율 | 초당 읽히는 바이트 수. | 1초 | 바이트/초 |
| 바이트 쓰기 비율 | 초당 쓰여지는 바이트 수. | 1초 | 바이트/초 |
| 대기 시간 | I/O 작업당 평균 소요 시간. | 1초 | 밀리초 |
| 처리량 | 초당 수행되는 읽기 및 쓰기 작업의 총 횟수. | 1초 | IOPS |
| 전송 비율 | 초당 읽기 및 쓰기 데이터 양. | 1초 | 바이트/초 |
| 읽기 % | 전체 디스크 I/O 작업 중 읽기 작업이 차지하는 비율. | 1초 | 백분율 |
| 쓰기 % | 전체 디스크 I/O 작업 중 쓰기 작업이 차지하는 비율. | 1초 | 백분율 |
| 읽기 요청 | 완료된 읽기 작업 수를 시간 간격 길이로 나눈 값. | 1초 | 초당 요청 수 |
| 쓰기 요청 | 완료된 쓰기 작업 수를 시간 간격의 길이로 나눈 값. | 1초 | 초당 요청 수 |
| 평균 요청 대기열 길이 | 초당 읽기 및 쓰기 데이터 양. | 1초 | 숫자 |
네트워크 인터페이스
다음 표는 인터페이스별 네트워크 트래픽 및 오류를 요약합니다.
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 인터페이스 | 통신에 사용 중인 네트워크 인터페이스. | 60초 |
| Mac | 네트워크 인터페이스의 미디어 액세스 제어(MAC) 주소. | 60초 |
| IP | 네트워크 인터페이스에 할당된 IP 주소들. | 60초 |
| RX 바이트 | 네트워크 인터페이스가 초당 수신하는 총 바이트 수. | 1초 |
| RX 오류 | 네트워크 인터페이스에서 데이터를 수신하는 동안 발생하는 오류의 수. | 1초 |
| TX 바이트 | 네트워크 인터페이스가 초당 전송하는 총 바이트 수. | 1초 |
| TX 오류 | 네트워크 인터페이스에서 패킷을 전송하는 동안 발생하는 오류의 총 개수. | 1초 |
| 수신됨/초 | 네트워크 인터페이스가 초당 수신하는 패킷 수. | 1초 |
| 전송됨/초 | 네트워크 인터페이스가 초당 전송하는 패킷 수. | 1초 |
TCP 활동
이러한 지표는 확립된 연결, 세그먼트 전송률 및 오류 발생을 포함한 TCP 연결 활동에 대한 통찰력을 제공합니다.
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| 설정됨 | TCP 로 설정된 연결 수. | 1초 |
| 열기/초 | 초당 새로 열린 TCP 연결 수. | 1초 |
| 인 세그먼트/초 | 초당 수신되는 TCP 세그먼트 수. | 1초 |
| 아웃 세그먼트/초 | 초당 발신되는 TCP 세그먼트 수. | 1초 |
| 연결된 재설정 | 초당 재설정된 확립된 TCP 연결 수. | 1초 |
| 아웃 재설정 | 초당 리셋된 아웃바운드 TCP 연결 수. | 1초 |
| 실패 | 초당 실패한 TCP 연결 시도 횟수. | 1초 |
| 오류 | 초당 발생하는 TCP 오류 수. | 1초 |
| 재전송 | 초당 전송된 TCP 재전송 횟수. | 1초 |
프로세스 상위 목록
상위 프로세스 목록은 실행 중인 프로세스에 대한 포괄적인 정보를 제공하며, 여기에는 프로세스 식별자, 이름, 리소스 사용량 메트릭 및 소유권 정보가 포함됩니다. 이 목록은 30초마다 업데이트되며 특정 리소스 사용량 기준을 충족하는 프로세스만 표시합니다: 지난 30초 동안 CPU 사용량이 10%를 초과한 프로세스 또는 메모리 사용량(RSS)이 512MB를 초과하는 프로세스입니다.
상위 10개 CPU 집약적 프로세스와 상위 10개 메모리 집약적 프로세스를 결합한 통합 보기를 생성하려면 를 true로 combineTopProcesses 구성하십시오. 이 구성은 프로세스가 표준 임계값을 충족하는지 여부와 관계없이 결합된 목록에 포함됩니다. 프로세스가 CPU 상위 10개 목록과 메모리 상위 10개 목록에 동시에 나타날 경우, 해당 프로세스는 한 번만 표시됩니다. 이로 인해 최대 20개의 고유 항목으로 구성된 통합 목록이 생성됩니다.
com.instana.plugin.host:
combineTopProcesses: true # [true, false]
Linuxtop 의미론이 사용된다. 100% CPU는 단일 CPU 코어의 완전한 사용을 의미하며, 지난 달의 스냅샷 기록을 검색할 수 있습니다. 정규화된 CPU는 CPU를 논리 프로세서 수로 나눈 값으로 계산됩니다.
| 메트릭 | 설명 | 세분성 |
|---|---|---|
| PID | 운영 체제가 각 프로세스에 할당하는 고유 식별자. | 30초 |
| 프로세스 이름 | 애플리케이션 또는 서비스에 의해 정의된 프로세스의 이름. | 30초 |
| PPID | 이 프로세스를 생성한 부모 프로세스의 프로세스 ID. | 30초 |
| UID | 프로세스를 소유하고 실행하는 사용자 계정의 숫자형 사용자 식별자. | 30초 |
| GID | 프로세스 소유자와 연관된 숫자 그룹 식별자. | 30초 |
| 경과 시간 | 프로세스가 시작된 이후 경과한 총 시간. | 30초 |
| CPU | 프로세스가 소비하는 CPU 리소스의 양. | 30초 |
| CPU(정규화됨) | 프로세스의 CPU 사용량, 표준화된 척도로 표시됨. | 30초 |
| 메모리 | 프로세스가 소비하는 메모리 양. | 30초 |
패키지 목록 추출
파일에서 configuration.yaml 를 collectInstalledSoftware 로 true 설정하면 운영 체제에 설치된 패키지를 하루에 한 번 추출할 수 있습니다.
현재 지원되는 Linux 배포판은 다음과 같습니다.
- Debian 기반 (
dpkg) - Red Hat -기반 (
rpm및yum)
com.instana.plugin.host:
collectInstalledSoftware: true # [true, false]
파일 정보 속성
root (/) 디렉터리에서 크기 기준 상위 10개 파일 또는 디렉터리에 대한 다음 파일 속성을 확인하려면, 파일에서 configuration.yaml 를 getFileInfo 로 true 설정하면 됩니다.
| 메트릭 | 설명 |
|---|---|
| 파일 이름 | 파일 또는 디렉토리 이름입니다. |
| 마지막 액세스한 시간 | 마지막 파일 액세스 날짜 및 시간입니다. |
| 최종 변경 시간 | 파일을 마지막으로 변경한 날짜 및 시간입니다. |
| 액세스 | 이 속성은 파일의 접근 권한을 정의합니다. |
| 유형 | 파일의 유형(파일 또는 디렉터리). |
| 크기 | 파일의 크기(바이트 단위). |
| 컨텐츠 변경됨 | 파일 내용이 변경되었는지 여부를 나타냅니다(예 또는 아니오). |
| 소유자 | 파일 소유자의 이름입니다. |
| 그룹 | 파일 소유자가 속한 논리 그룹의 이름입니다. |
com.instana.plugin.host:
getFileInfo: true # [true, false]
각 센서에 대해, 건강 상태 시그니처로 구성된 지식 베이스가 유입되는 메트릭에 대해 지속적으로 평가되며, 사용자 영향에 기반하여 문제 또는 사고를 발생시킵니다.
내장 이벤트는 엔티티의 상태 지표가 정상 범위를 벗어날 경우 이슈나 인시던트를 발생시키며, 사용자 정의 이벤트는 엔티티의 개별 메트릭 임계값을 기준으로 이슈나 인시던트를 발생시킵니다.
호스트 센서의 내장 이벤트에 대한 자세한 내용은 내장 이벤트 참조를 참조하십시오.