호스트 알림 트리거 조건

호스트의 속성, 용량, 성능을 검사하고 변경 사항이나 위반 사항이 감지되면 알려주도록 IBM Storage Insights Pro를 설정할 수 있습니다.

알림은 다음 리소스에 대한 일반적인 변경 사항, 용량 및 성능 문제를 알려줄 수 있습니다:
중요: 알림을 보낼 수 있는 모든 속성이 여기에 나열되어 있는 것은 아닙니다. 알림을 보낼 수 있는 전체 속성 목록을 보려면 알림 정책이 할당되지 않은 호스트에 대한 알림 정의를 편집하거나, 새 사용자 지정 알림 정책을 만들고 정책에서 새 알림을 정의할 수 있습니다. 사용자 지정 알림 정책을 만들려면 구성 > 알림 정책으로 이동하여 정책 만들기을 클릭합니다.

표에서 기본 경보는 별표(*)로 표시됩니다.

호스트(일반 변경 사항)

표 1. 호스트에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
상태*
호스트에서 다음 상태 중 하나가 감지되었습니다:
정상 아님
호스트 또는 호스트의 내부 리소스에서 오류 또는 경고 상태가 감지되었습니다.
경고
호스트 또는 호스트의 내부 리소스에서 경고 상태가 감지되었습니다.
오류(기본값)
호스트 또는 호스트의 내부 리소스에서 오류 상태가 감지되었습니다.
연결할 수 없음
호스트에 대해 모니터링되는 리소스 중 하나 이상이 응답하지 않습니다. 이 상태는 네트워크 문제가 원인일 수 있습니다.
프로브 상태*
프로브에 대해 다음 상태 중 하나가 발견될 때 경보를 생성합니다.
성공하지 못함
데이터 콜렉션 동안 오류 또는 경고가 발생했습니다. 이 상태는 프로브가 데이터를 수집하지 않거나 자원에 대한 부분 데이터 세트만 수집했음을 표시합니다.
경고
프로브가 완료되었지만 전체 데이터 세트를 수집하지 않았을 수 있습니다. 이 상태는 데이터를 하나 이상의 내부 자원에 대해 수집할 수 없는 경우 발생할 수 있습니다.
오류
자원에 대한 자산 데이터를 수집하려고 시도할 때 프로브가 완료되지 않았습니다. 이 상태는 데이터 콜렉션 동안 자원에 연결되지 않은 경우 발생할 수 있습니다.
성능 모니터 상태*
성능 모니터에 대해 다음 중 하나의 상태를 발견했습니다.
성공하지 못함
데이터 콜렉션 동안 오류 또는 경고가 발생했습니다. 이 상태는 성능 모니터가 데이터를 수집하지 않거나 자원에 대한 부분 데이터 세트만 수집했음을 표시합니다.
경고
성능 모니터가 완료되었지만 성능 데이터의 전체 세트를 수집하지 않았습니다. 이 상태는 데이터 콜렉션 동안 자원이 재부팅된 경우, 자원에서 유효한 성능 데이터가 제공하지 않은 경우, 자원 또는 연관된 에이전트와 통신할 때 오류가 발생한 경우 발생할 수 있습니다.
오류
자원에 대한 성능 데이터를 수집하려고 시도할 때 성능이 완료되지 않았습니다. 이 상태는 데이터 콜렉션 동안 자원에 연결되지 않거나 자원에 대해 사용 가능한 구성 데이터가 없는 경우 발생할 수 있습니다.

마지막으로 성공한 프로브

마지막으로 성공한 모니터

프로브 또는 성능 모니터가 호스트에 대한 데이터를 수집할 수 있는 지정된 시간이 경과했습니다. 이 알림을 사용하면 호스트에 대한 최신 구성, 상태 또는 성능 데이터가 수집되지 않고 기존 데이터가 오래되었을 수 있는 경우 알림을 받을 수 있습니다. 리소스, 네트워크 또는 서버를 사용할 수 없는 경우 이러한 상황이 발생할 수 있습니다.

호스트(용량 변경)

호스트의 용량이 지정된 임계값을 벗어날 때 알려주는 알림을 정의합니다. 알림에서 사용된 용량, 사용 가능한 용량, 파일 시스템 용량 등 호스트의 용량을 측정하는 메트릭을 기반으로 조건을 지정할 수 있습니다. 용량 조건으로 알림을 생성하면 네트워크 인프라의 잠재적인 병목 현상에 대한 알림을 받을 수 있습니다.

예를 들어, 사용된 SAN 용량이 지정된 임계값보다 크거나 같을 때 알림을 받도록 경고를 정의할 수 있습니다. 사용된 SAN 용량은 호스트와 연결된 볼륨이 사용하는 총 SAN 스토리지 용량을 나타냅니다. 이 알림을 사용하면 호스트가 사용 중인 SAN 용량을 파악하는 데 도움이 됩니다.

또한 메트릭이 지정된 임계값보다 작을 때(예: SAN 용량을 적게 사용하는 호스트를 식별하려는 경우) 알림을 받을 수도 있습니다.

알림을 받을 수 있는 호스트 메트릭의 전체 목록은 표 2 표를 참조하세요.
표 2. 호스트 용량 메트릭
지표 정의
SAN 용량 호스트에 할당된 스토리지 시스템의 SAN 디스크 용량입니다.
사용된 SAN 용량 호스트와 연결된 볼륨이 사용하는 SAN 스토리지의 총 용량입니다.
FlashCopy® 프로비저닝된 용량 모든 FlashCopy 대상의 총 저장 공간 용량입니다.
FlashCopy 사용된 용량 FlashCopy 타깃이 사용하는 저장 공간입니다.
기본 프로비저닝된 용량 호스트에 직접 매핑된 볼륨의 총 저장 공간 용량입니다.
기본 사용 용량 호스트에 직접 매핑된 볼륨에 사용되는 스토리지 공간입니다.
원격 미러 프로비저닝된 용량 메트로 미러 또는 글로벌 미러와 같은 복사본 서비스 관계의 대상이 되는 볼륨의 총 저장 공간 용량입니다.
원격 미러 사용 용량 메트로 미러 또는 글로벌 미러와 같이 복사 서비스 관계의 대상인 볼륨에 사용되는 저장 공간입니다.
VDisk 미러 프로비저닝된 용량 모든 VDisk 사본의 총 스토리지 용량입니다.
VDisk 미러 사용 용량 V디스크 복사본이 사용하는 스토리지 용량입니다.
우수 사례: 용량 조건에 대한 임계값을 설정할 때는 너무 많은 허위 알림을 생성하지 않고 최대 효과를 얻을 수 있도록 최적의 값을 결정하세요. 적절한 임계값은 실행 중인 워크로드의 유형, 하드웨어 구성, 물리적 디스크의 수, 정확한 모델 번호, 기타 요소에 따라 상당히 다르므로 간단하거나 표준적인 기본 규칙은 없습니다.

권장되는 접근 방식은 몇 주 동안 리소스의 용량을 모니터링하고 이 기록 데이터를 사용하여 각 용량 조건에 대한 합리적인 임계값을 결정하는 것입니다. 이 작업이 완료되면 조건 설정을 세밀히 조정하여 거짓 경보의 수를 최소화할 수 있습니다.

알람 정의 편집를 클릭하고 각 용량 알림 정의에 대해 기록 보기를 클릭하여 호스트 용량 기록을 확인하고 해당 데이터와 관련하여 원하는 임계값을 설정합니다.

Tip: 용량 속성의 경우 저장 용량이 지정된 값보다 크거나 작거나 같을 때 알림을 생성할 수 있습니다. 속성의 측정 단위(예: KiB, MiB, GiB 또는 TiB)도 결정할 수 있습니다.

호스트(성능 변경)

호스트의 성능이 지정된 임계값을 벗어날 때 알려주는 알림을 정의합니다. 알림에서 응답 시간, I/O 속도, 데이터 속도 등 호스트의 성능을 측정하는 메트릭을 기반으로 조건을 지정할 수 있습니다. 성능 조건을 사용해서 경보를 작성하여 네트워크 인프라의 잠재적인 병목 현상에 대한 정보를 받을 수 있습니다.

예를 들어 드라이브의 총 응답 시간이 지정된 임계값보다 크거나 같을 때 알림을 받도록 경고를 정의할 수 있습니다. 총 응답 시간은 백엔드 스토리지 리소스가 읽기 또는 쓰기 작업에 응답하는 데 걸리는 평균 시간(밀리초)을 나타냅니다. 이 알림을 사용하면 호스트의 성능을 저하시킬 수 있는 디스크 상태를 파악하는 데 도움이 됩니다.

응답 시간이 짧은 드라이브를 식별하려는 경우와 같이 메트릭이 지정된 임계값보다 낮을 때 알림을 받을 수도 있습니다.

알림을 받을 수 있는 호스트 메트릭의 전체 목록은 호스트에 대한 성능 메트릭를 참조하세요.
성능 조건에 대한 팁:
  • 데이터 수집은 리소스에 대해 일정 시간 동안 실행되어야 IBM Storage Insights Pro가 임계값 위반 여부를 판단하고 성능 조건에 대한 알림을 생성할 수 있습니다.
우수 사례: 성능 조건에 대한 임계값을 설정할 때는 너무 많은 허위 알림을 생성하지 않고 최대 효과를 얻을 수 있도록 최적의 값을 결정하세요. 적절한 임계값은 실행 중인 워크로드의 유형, 하드웨어 구성, 물리적 디스크의 수, 정확한 모델 번호, 기타 요소에 따라 상당히 다르므로 간단하거나 표준적인 기본 규칙은 없습니다.

몇 주 동안 자원의 성능을 모니터하고 이 히스토리 데이터를 사용하여 각 성능 조건에 적합한 임계값을 판별하는 방법을 사용하는 것이 좋습니다. 이 작업이 완료되면 조건 설정을 세밀히 조정하여 거짓 경보의 수를 최소화할 수 있습니다.

알림 정의 수정을 클릭하고 각 성능 알림 정의에 대해 기록 보기을 클릭하여 호스트 성능 기록을 확인하고 해당 데이터와 관련하여 원하는 임계값을 설정합니다.

HBA(일반 변경 사항)

표 3. HBA에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
상태
다음 상태 중 하나가 HBA에서 감지됩니다:
정상 아님
HBA에서 오류 또는 경고 상태가 감지되었습니다.
경고
HBA에서 경고 상태가 감지되었습니다.
오류(기본값)
HBA에서 오류 상태가 감지되었습니다.
제거된 HBA 이전에 모니터링한 HBA를 더 이상 찾을 수 없습니다. HBA에 대한 과거 데이터는 유지되지만 현재 데이터는 수집되지 않습니다. 이 알림을 사용하면 HBA가 제거되거나 사용할 수 없게 되는 경우 알림을 받을 수 있습니다.
새 HBA HBA가 처음으로 감지되었습니다.

드라이브(일반 변경 사항)

표 4. 드라이브에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
상태
디스크에서 다음 중 하나의 상태를 발견했습니다.
정상 아님
디스크에서 오류 또는 경고 상태를 발견했습니다.
경고
디스크에서 경고 상태를 발견했습니다.
오류(기본값)
디스크에서 오류 상태를 발견했습니다.
제거된 드라이브 이전에 모니터링한 드라이브를 더 이상 찾을 수 없습니다. 드라이브에 대한 과거 데이터는 유지되지만 현재 데이터는 수집되지 않습니다. 드라이브가 제거되거나 사용할 수 없게 되면 알림을 받으려면 이 알림을 사용하세요.
새 드라이브 드라이브가 처음으로 감지되었습니다. 이 알림을 사용하여 호스트의 하드웨어 변경 사항에 대한 알림을 받습니다.
경로 드라이브와 연결된 액세스 경로의 수가 지정된 범위를 벗어나거나 지정된 값과 같거나 같지 않습니다.

드라이브(용량 변경)

표 5. 드라이브에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
용량 호스트 드라이브에 할당된 총 스토리지 용량입니다.
사용 가능한 드라이브 용량 호스트 드라이브의 미사용 용량입니다.
사용된 용량 호스트 드라이브에서 사용된 스토리지 용량의 양입니다.

드라이브(성능 변경)

표 6. 드라이브에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
I/O 비율(읽기) 백엔드 스토리지 자원에 대해 실행된 초당 평균 읽기 조작 수입니다.
I/O 비율(쓰기) 백엔드 스토리지 자원에 대해 실행된 초당 평균 쓰기 조작 수입니다.
I/O 비율(총계) 백엔드 스토리지 자원과 구성요소 간에 전송된 초당 평균 I/O 조작 수입니다. 이 값은 읽기 및 쓰기 조작을 모두 포함합니다.
데이터 비율(읽기) 백엔드 스토리지 자원에서 읽은 초당 평균 MiB 수입니다.
데이터 비율(쓰기) 백엔드 스토리지 자원에 쓴 초당 평균 MiB 수입니다.
데이터 비율(총계) 백엔드 스토리지 자원과 구성요소 간에 전송된 데이터의 평균 비율입니다. 비율은 초당 MiB 단위로 측정되며 읽기 조작과 쓰기 조작을 둘 다 포함합니다.
응답 시간(읽기) 백엔드 스토리지 자원이 읽기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.
응답 시간(쓰기) 백엔드 스토리지 자원이 쓰기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.
응답 시간(총계) 백엔드 스토리지 자원이 읽기 또는 쓰기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.

경로(일반 변경 사항)

표 7. 경로에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
상태
경로에서 다음 중 하나의 상태를 발견했습니다.
정상 아님
경로에서 오류 또는 경고 상태를 발견했습니다.
경고
경로에서 경고 상태를 발견했습니다.
오류(기본값)
경로에서 오류 상태를 발견했습니다.
삭제된 경로 이전에 모니터링한 호스트 드라이브의 액세스 경로를 더 이상 찾을 수 없습니다. 이 변경 사항은 사용 가능한 경로가 둘 이상일 수 있으므로 드라이브의 가용성에 영향을 미칠 수도 있고 그렇지 않을 수도 있습니다.
새 경로 드라이브의 액세스 경로가 처음으로 감지되었습니다.

데이터스토어(일반 변경 사항)

표 8. 데이터스토어에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
상태
데이터스토어에서 다음 상태 중 하나가 감지되었습니다:
정상 아님
데이터스토어에서 오류 또는 경고 상태가 감지되었습니다.
경고
데이터스토어에서 경고 상태가 감지되었습니다.
오류(기본값)
데이터스토어에서 오류 상태가 감지되었습니다.
제거된 데이터 저장소 이전에 모니터링한 데이터스토어를 더 이상 찾을 수 없습니다. 데이터스토어에 대한 과거 데이터는 유지되지만 현재 데이터는 수집되지 않습니다. 데이터스토어가 제거되거나 사용할 수 없게 되면 알림을 받으려면 이 알림을 사용하세요.
새 데이터 저장소 데이터스토어가 처음으로 감지되었습니다.

데이터스토어(용량 변경)

표 9. 데이터스토어에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
사용한 용량(%) 호스트 데이터 스토어에서 사용되는 스토리지 용량의 백분율입니다.
용량 호스트에 할당된 스토리지 시스템의 SAN 디스크 용량입니다.
사용된 용량 호스트와 연결된 데이터스토어에서 사용하는 SAN 스토리지의 총 용량입니다.
사용 가능한 용량 호스트 데이터 저장소의 미사용 스토리지 용량입니다.
파일 시스템 용량 자원의 파일 시스템에 있는 스토리지 공간의 크기입니다.
사용한 파일 시스템 용량 호스트 파일 시스템에서 사용된 용량입니다.
사용 가능한 파일 시스템 용량 파일 시스템에서 사용하지 않은 총 스토리지 용량의 크기입니다.

데이터스토어(성능 변경)

표 10. 데이터스토어에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
I/O 비율(읽기) 백엔드 스토리지 자원에 대해 실행된 초당 평균 읽기 조작 수입니다.
I/O 비율(쓰기) 백엔드 스토리지 자원에 대해 실행된 초당 평균 쓰기 조작 수입니다.
I/O 비율(총계) 백엔드 스토리지 자원과 구성요소 간에 전송된 초당 평균 I/O 조작 수입니다. 이 값은 읽기 및 쓰기 조작을 모두 포함합니다.
데이터 비율(읽기) 백엔드 스토리지 자원에서 읽은 초당 평균 MiB 수입니다.
데이터 비율(쓰기) 백엔드 스토리지 자원에 쓴 초당 평균 MiB 수입니다.
데이터 비율(총계) 백엔드 스토리지 자원과 구성요소 간에 전송된 데이터의 평균 비율입니다. 비율은 초당 MiB 단위로 측정되며 읽기 조작과 쓰기 조작을 둘 다 포함합니다.
응답 시간(읽기) 백엔드 스토리지 자원이 읽기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.
응답 시간(쓰기) 백엔드 스토리지 자원이 쓰기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.
응답 시간(총계) 백엔드 스토리지 자원이 읽기 또는 쓰기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.

VMDK(일반 변경 사항)

표 11. VMDK에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
제거된 VMDK 이전에 모니터링한 VMDK를 더 이상 찾을 수 없습니다. VMDK에 대한 과거 데이터는 유지되지만 현재 데이터는 수집되지 않습니다. 이 알림을 사용하면 VMDK가 제거되거나 사용할 수 없게 되는 경우 알림을 받을 수 있습니다.
새 VMDK VMDK가 처음으로 감지되었습니다.

VMDK(용량 변경)

표 12. VMDK에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
사용된 용량 호스트 데이터 저장소의 VMDK에서 사용되는 스토리지 용량의 백분율입니다.
크기 호스트 데이터 저장소에 있는 VMDK의 크기입니다.

VMDK(성능 변경)

표 13. VMDK에 대한 사전 정의된 알림
일반 속성 속성에 대한 조건 정의
I/O 비율(읽기) 백엔드 스토리지 자원에 대해 실행된 초당 평균 읽기 조작 수입니다.
I/O 비율(쓰기) 백엔드 스토리지 자원에 대해 실행된 초당 평균 쓰기 조작 수입니다.
I/O 비율(총계) 백엔드 스토리지 자원과 구성요소 간에 전송된 초당 평균 I/O 조작 수입니다. 이 값은 읽기 및 쓰기 조작을 모두 포함합니다.
데이터 비율(읽기) 백엔드 스토리지 자원에서 읽은 초당 평균 MiB 수입니다.
데이터 비율(쓰기) 백엔드 스토리지 자원에 쓴 초당 평균 MiB 수입니다.
데이터 비율(총계) 백엔드 스토리지 자원과 구성요소 간에 전송된 데이터의 평균 비율입니다. 비율은 초당 MiB 단위로 측정되며 읽기 조작과 쓰기 조작을 둘 다 포함합니다.
응답 시간(읽기) 백엔드 스토리지 자원이 읽기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.
응답 시간(쓰기) 백엔드 스토리지 자원이 쓰기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.
응답 시간(총계) 백엔드 스토리지 자원이 읽기 또는 쓰기 조작에 대해 응답하는 데 걸린 평균 시간(밀리초)입니다.