대상 사이트에서 메인 사이트로 배포 제어를 다시 전환하기
기본 사이트가 준비되면 배포 제어를 대상 사이트에서 기본 사이트로 다시 전환합니다.
시작하기 전에
페일백 작업을 시작하기 전에 재해 복구 대시보드를 열고, 필요한 모든 상태 점검 항목을 검토하여 시스템 준비 상태를 확인하십시오. 페일백 작업을 진행하기 전에 실패한 검사를 모두 해결하십시오.
장애 복구 작업을 진행하기 전에 다음 시나리오를 고려하세요.
- 기본 사이트가 복구되어 작동 상태가 되면 기본 사이트와 대상 사이트 모두 참조된 모든 관리형 호스트를 표시합니다. 그러나 기본 사이트에서는 이러한 관리 호스트를 '알 수 없음' 상태로 표시합니다. 이는 활성화 프로세스 중에 관리되는 호스트가 대상 콘솔로 리호밍되었기 때문에 발생합니다. 이 문제를 해결하려면 다음 작업을 완료하세요.
- 기본 사이트에서 장애 복구 작업을 실행하기 전에 알 수 없음 상태인 관리되는 호스트를 기본 사이트에서 제거합니다.
- 메인 사이트 MH가 HA로 구성되어 있고 활성화 시점에 메인 사이트가 다운된 경우, 메인 사이트의 전원을 켠 후 알 수 없음 상태인 HA를 제거하기 위해 추가 단계를 수행해야 합니다. ‘ QRadar HA 배포 문제 해결’에 설명된 단계를 따라도 콘솔에서 HA 호스트를 제거할 수 없는 경우, IBM 지원팀에 문의하십시오.
- 모든 앱이 기본 사이트에 연결되는 AppHost 에서 호스팅되는 경우, 기본 사이트 콘솔에서 알 수 없는 앱 호스트를 제거할 수 없습니다. 현재 앱 호스트가 대상 사이트로 재배치되었으므로, AppHost, 에서 모든 앱(데이터 동기화 앱 포함)의 구성 및 볼륨 데이터를 메인 사이트 콘솔로 이동해야 합니다. 장애 복구 작업을 실행하기 전에 데이터 동기화 앱이 기본 사이트에서 정상적으로 작동해야 합니다. “ QRadar : 앱 호스트가 복구 불가능한 경우 애플리케이션을 콘솔에서 실행하도록 강제하는 방법”을 참조하여, ‘알 수 없음(Unknown)’ 상태인 앱을 메인 사이트 콘솔에서 실행하도록 강제한 다음, 메인 사이트 콘솔에서 ‘ AppHost ’을 제거할 수 있습니다.
- 관리되는 호스트가 여전히 활성으로 표시되는 경우 지원 티켓을 열어 근본 원인을 파악하고 기본 사이트 콘솔에서 해당 호스트를 제거하세요.
- 주 사이트가 실행 중이지만 주 사이트와 대상 사이트 간의 페어링 연결이 갑자기 끊어지는 경우. 페어링 연결을 다시 설정하려면 다음 작업을 완료하세요.
- 메인 사이트의 QRadar 콘솔에서 다음 명령을 실행합니다:
/opt/ibm/si/dr/bin/dr_create_ssh.sh -i <destination_site_ip> - 대상 사이트의 QRadar 콘솔에서 다음 명령을 실행합니다:
/opt/ibm/si/dr/bin/dr_create_ssh.sh -i <main_site_ip>
- 메인 사이트의 QRadar 콘솔에서 다음 명령을 실행합니다:
기본 사이트 콘솔과 대상 사이트 콘솔 모두에서 새 백업을 수행하려면 관리자 사용자로 로그인해야 합니다. 백업이 생성되면 시스템은 생성된 백업을 다른 사이트로 전송합니다. 백업 및 복구 화면을 열어 전송된 백업이 표시되는지 확인합니다. 전송된 백업이 보이지 않으면 백업 및 복구 화면을 새로 고칩니다.
페일백은 대상 사이트가 더 이상 메인 사이트의 작업을 대체할 필요가 없을 때 메인 사이트로 복원하는 작업입니다. 메인 사이트에 다시 실패하면 아리엘 복사 프로세스가 수집된 아리엘 데이터를 복사합니다. 데이터는 대상 사이트가 활성화된 시점부터 장애 복구 프로세스가 시작된 시간이 끝날 때까지의 데이터입니다.
- 대상 사이트가 활성 상태인 시간입니다.
- 활성 상태인 동안 대상 사이트에서 수집된 데이터의 양입니다.
- 대상 사이트와 주 사이트 간에 사용 가능한 대역폭입니다.
Ariel Copy는 시간에서 가장 가까운 시간까지만 허용합니다. 장애 복구가 시작되는 시간은 가장 가까운 시간으로 반올림됩니다. 오전 9:15 AM은 Ariel Copy 프로파일에 오전 9시로 저장됩니다. Ariel Copy는 전체 시간의 데이터를 동기화합니다. 예를 들어 오전 9시부터 오전 9시 59분까지입니다.
이 장애 복구 프로세스에서 아리엘 동기화가 완료되고 대상 사이트에서 아리엘 복사본이 완료되었다는 알림을 받습니다. 아리엘 동기화가 완료되면 대상 사이트에서 활성화 후 생성되어 메인 사이트로 전송된 최신 백업을 사용하여 메인 사이트에서 복원이 자동으로 시작됩니다. 주 사이트 복원이 완료되면 대상 사이트에서 복원이 시작됩니다.
활성화하는 동안 기본 사이트를 사용할 수 없는 경우 (활성화 시나리오 1), 관리자가 활성화 전에 시작한 대상 사이트의 최신 백업이 장애 복구 프로세스 중에 대상 사이트에 복원됩니다.
앱 복원의 경우, 관리자가 활성화 전에 시작한 대상 사이트의 최신 앱 볼륨 백업이 장애 복구 프로세스 중에 대상 사이트에 복원됩니다.
활성화 중에 기본 사이트를 사용할 수 있는 경우 (활성화 시나리오 2), 장애 복구 프로세스 중에 대상 사이트로 전송된 최신 기본 사이트 백업이 대상 사이트에서 복원됩니다.
앱 복원의 경우, 장애 복구 프로세스 중에 대상 사이트로 전송된 기본 사이트의 최신 앱 볼륨 백업이 대상 사이트에서 복원됩니다.
콘솔에 설치된 앱은 장애 조치 및 장애 복구 작업 중에만 지원됩니다. 앱이 AppHost, 에 설치되어 있는 경우 장애 조치 및 장애 복구 작업 중에 앱이 복원되거나 마이그레이션되지 않습니다.
앱 볼륨 백업은 매일 일정에 따라 자동으로 전송됩니다. 그러나 최신 볼륨 백업을 하는 것이 좋습니다.
- 대상 사이트 콘솔에서 앱 볼륨 백업을 수행하려면 다음과 같이 하세요:
- 콘솔에서 실행되는 앱
- 대상 사이트 콘솔에서 앱 볼륨 데이터를 백업하려면 “앱 데이터 백업 및 복원”을 참조하십시오.
- 대상 사이트 콘솔에서 다음 명령을 실행하여 앱 볼륨 백업을 대상 사이트 콘솔에서 기본 사이트 콘솔로 전송합니다.
systemctl start app_sync - 기본 사이트 콘솔 디렉토리(/store/app_sync/backups)에서 전송을 확인합니다. 전송에 실패하거나 문제가 있는 경우 대상 사이트 콘솔(/store/apps/backup) 디렉터리에서 기본 사이트 콘솔(/store/app_sync/backups) 디렉터리로 앱 볼륨 백업을 복사합니다.
- 다음에서 실행되는 앱 AppHost
- 설치된 모든 앱을 대상 사이트 콘솔로 이동합니다
- 대상 사이트 콘솔에서 앱 볼륨 데이터를 백업하려면 “앱 데이터 백업 및 복원”을 참조하십시오.
- 대상 사이트 콘솔에서 다음 명령을 실행하여 앱 볼륨 백업을 대상 사이트 콘솔에서 기본 사이트 콘솔로 전송합니다.
systemctl start app_sync - 기본 사이트 콘솔 디렉토리(/store/app_sync/backups)에서 전송을 확인합니다. 전송에 실패하거나 문제가 있는 경우 대상 사이트 콘솔(/store/apps/backup) 디렉터리에서 기본 사이트 콘솔(/store/app_sync/backups) 디렉터리로 앱 볼륨 백업을 복사합니다.
- 콘솔에서 실행되는 앱
- 기본 사이트 콘솔(콘솔에서 실행되는 앱)에서 앱 볼륨 백업을 수행하려면 다음과 같이 하세요:
- 메인 사이트 콘솔에서 앱 볼륨 데이터를 백업하려면 “앱 데이터 백업 및 복원”을 참조하십시오.
- 기본 사이트 콘솔(/store/app_sync/backups)에서 대상 사이트 콘솔(/store/app_sync/backups) 디렉토리로 앱 볼륨 백업 데이터를 전송합니다. 이 단계는 활성화 시나리오 2에서 사용할 수 있었던 기본 사이트에만 필요합니다.
- 기본 사이트 콘솔에서 다음 명령을 실행하여 앱 볼륨 백업 데이터를 기본 사이트 콘솔에서 대상 사이트 콘솔로 전송합니다.
systemctl start app_sync - 대상 사이트 콘솔 디렉토리(/store/app_sync/backups)에서 전송을 확인합니다. 전송에 실패하거나 문제가 있는 경우 기본 사이트 콘솔(/store/apps/backup) 디렉터리에서 대상 사이트 콘솔(/store/app_sync/backups) 디렉터리로 앱 볼륨 백업을 복사합니다.
프로시저
다음에 수행할 작업
- 활성화가 완료되면 두 사이트 간의 페어링 연결이 제거됩니다. 페어링 연결을 다시 설정하려면 두 사이트 모두에서 다음 페어링 명령을 실행해야 합니다.
- 메인 사이트의 QRadar 콘솔에서 다음 스크립트를 실행합니다:
./opt/ibm/si/dr/bin/dr_create_ssh.sh -i <destination_site_ip> - 대상 사이트의 QRadar 콘솔에서 다음 스크립트를 실행합니다:
./opt/ibm/si/dr/bin/dr_create_ssh.sh -i <main_site_ip>
- 메인 사이트의 QRadar 콘솔에서 다음 스크립트를 실행합니다:
- AppHost 에 설치된 앱은 장애 조치 및 장애 복구 작업 중에 복원되거나 마이그레이션되지 않습니다. 기본 콘솔에서 대상 사이트 앱을 복원하려면 다음 단계를 수행합니다
- 메인 사이트의 사용자가 대상 사이트에서 사용할 수 있었지만 메인 사이트에서는 액세스할 수 없는 애플리케이션에 액세스해야 하는 경우 메인 콘솔 사이트 -> IBM QRadar 허브 (이전의 IBM QRadar 지원) -> 애플리케이션 -> 설치된 확장 프로그램 섹션을 사용하여 해당 애플리케이션을 다시 설치해야 합니다.
성공적으로 복원하려면 기본 사이트와 대상 사이트 모두에서 앱 버전이 동일해야 합니다.
- 복원 작업을 진행하기 전에 기본 사이트 콘솔에서 기존 앱의 볼륨 데이터를 백업하세요.
- 기본 사이트 콘솔에서 올바른 앱 볼륨 백업을 사용할 수 있는지 확인합니다. 전송된 앱 볼륨 백업을 복원하려면 /store/app_sync/backups 에서 /store/apps/backup 으로 앱 볼륨 백업 데이터를 복사합니다.
- 필요한 앱과 크기가 작은 앱만 복원하세요. 대상 사이트에서 더 많은 앱을 복원하거나 DR 사이트에 앱을 더 오래 유지하려면 복원 절차를 진행하기 전에 먼저 대상 사이트 콘솔에서 AppHost 으로 앱을 마이그레이션할 수 있습니다.
- 앱 볼륨 데이터를 복원하려면 ‘앱 데이터 백업 및 복원’을 참조하십시오. 표준 관행은 대상 사이트 콘솔에서 데이터 동기화 앱 볼륨을 복원할 때 UUID를 사용하고 복원하지 않는 것입니다.
- 데이터 동기화 앱은 자체 상태를 유지하고 메인 사이트를 활성화하기 위해 페일백 작업을 실행하는 데 필요합니다.
- 복원이 완료된 후 또는 장애 조치 또는 장애 복구 작업 후에 오류 상태의 앱이 발견되면
qappmanager유틸리티(/opt/qradar/support/qappmanager)를 사용하여 앱을 다시 시작하세요.
- 메인 사이트의 사용자가 대상 사이트에서 사용할 수 있었지만 메인 사이트에서는 액세스할 수 없는 애플리케이션에 액세스해야 하는 경우 메인 콘솔 사이트 -> IBM QRadar 허브 (이전의 IBM QRadar 지원) -> 애플리케이션 -> 설치된 확장 프로그램 섹션을 사용하여 해당 애플리케이션을 다시 설치해야 합니다.
- 페일오버 및 페일백 후, 콘솔 호스트 라이선스 키가 복원되지 않습니다. 콘솔 호스트 라이선스는 그대로 유지되며, 각 메인 사이트 또는 대상 사이트에 보존됩니다. 관리형 호스트 라이선스 키 정보만 복원됩니다. 그 결과, 관리 대상 호스트는 라이선스 키에 정의된 해당 nonConsoleEventLimit 또는 flowLimit 값을 유지합니다. 복원 프로세스가 완료된 후에는 ‘콘솔 관리 (Console Admin) → 시스템 및 라이선스 관리 (System and License Management ) → 표시 변경(드롭다운): 라이선스(Licenses) → 라이선스 풀 관리(License Pool Management )’를 통해 라이선스 풀 할당을 수동으로 재구성해야 합니다.