Recuperação de desastre


OIBM Sterling Order Management System adota um plano abrangente de recuperação de desastres para evitar ou minimizar a perda de dados e a interrupção dos negócios devido a um evento catastrófico improvável, que pode interromper a continuidade dos negócios de seu ambiente de produção.
Esse plano de recuperação de desastre fornece a capacidade de recuperar os recursos do ambiente de produção e reduzir o impacto de uma interrupção do site. O plano muda seu Sterling™ Order Management System para usar um ambiente de recuperação de desastres (DR), que tem backup e é sincronizado com os dados mais recentes da produção necessários para a continuidade dos negócios.
Nota: O plano de recuperação de desastre do Sterling Order Management System é aplicável somente para ambientes de Produção.

O ambiente de Pré-produção é dimensionado para hospedar a instância regular do Sterling Order Management System (para tarefas de suporte de desempenho e produção) e a instância de DR inativa (como uma contingência). Ambas as instâncias compartilham máquinas virtuais para recursos de web, aplicativo e banco de dados. Durante um desastre declarado, a IBM coloca em quarentena o seu ambiente de Pré-produção, que é totalmente dedicado a restaurar a continuidade de negócios A arquitetura de recuperação de desastre inclui todos os servidores, rede, scripts e bancos de dados que estão envolvidos no backup de dados e comutadores entre os ambientes de Pré-produção e Produção, conforme necessário. O data center de Pré-Produção está alojado em um data center IBM® SoftLayer® diferente do data center do ambiente de Produção, geralmente em uma cidade ou localização geográfica diferente.

Como parte do plano de recuperação de desastre, dados operacionais e transacionais em seu ambiente de Produção, como pedidos, são replicados periodicamente durante todo o dia e submetidos a backup na instância de recuperação de desastre. O seu ambiente de Produção da web e seus dados do aplicativo são submetidos a backup por hora para a instância de recuperação de desastres Os dados do aplicativo incluem artefatos do sistema de arquivos, como CSS, imagens, conteúdo estático e artefatos de extensão SaaS .. O IBM também faz backup do ambiente principal e dos dados do site diariamente, como dados de infraestrutura e configuração, extensões e arquivos. Backups dos bancos de dados do ambiente de Produção também são concluídos diariamente. Os backups locais, que podem ser usados para eventos de recuperação em pequena escala, também são concluídos e movidos para um local de armazenamento remoto Os logs de transações são mantidos em seus data centers de recuperação em tempo real e de desastre.
Sem alterações nas URLs
Durante a DR, seu ambiente de produção funciona temporariamente em nosso DC de pré-produção. No entanto, os mesmos URLs permanecem os mesmos e nenhuma ação é necessária da sua parte.
Certificados
Não há necessidade de adicionar novos certificados para o DC de pré-produção e todas as conexões continuam funcionando como agora.
Lista de permissões da rede
Esta é uma configuração única para evitar quaisquer problemas relacionados à rede durante a DR. Se a sua configuração de integração envolver a inclusão de intervalos de IP ou domínios na lista de permissões, certifique-se de que os data centers Prod e DR (PO) estejam na lista de permissões.
Além disso, se você resolver e colocar IPs na lista de permissões fazendo ping ou executando um nslookup do domínio, é recomendável resolver e colocar os IPs na lista de permissões para o ambiente de pré-produção. Isso garante uma integração ininterrupta quando a pré-produção é usada como ambiente de produção temporário durante a DR.

Os dados do ambiente de produção, incluindo dados da web e de aplicativos, são replicados e armazenados em backup por meio de uma rede privada IBM SoftLayer entre seus ambientes de produção e pré-produção. Seus bancos de dados de recuperação de desastres são sempre mantidos em um estado quase pronto, portanto, use essa rede para replicar dados em um modo quase síncrono usando a opção de recuperação de desastres de alta disponibilidade (HADR).

Objetivos de Nível de Serviço (SLO)

Quando a IBM determinar razoavelmente que ocorreu um desastre, o processo de recuperação de desastre será iniciado A IBM tem um plano de recuperação de desastre completo no local que usa esforços comercialmente razoáveis para restaurar seu Sterling Order Management System para operações normais Durante o processo de recuperação de desastre, a equipe IBM se comunica com você por hora para atualizá-lo em relação ao status do processo de recuperação. Esta atualização inclui o progresso para o Objetivo do Tempo de Recuperação e Objetivo do Ponto de Recuperação. O Objetivo do tempo de recuperação é o tempo decorrido entre a declaração do desastre e a restauração do serviço do ambiente de produção. O Objetivo do Ponto de Recuperação é o ponto no tempo no passado para o qual seu ambiente se recupera, o que indica a quantia de perda de dados em potencial ou a idade de dados que devem ser recuperados dos backups de recuperação de desastre para que as operações normais sejam retomadas
  • O objetivo de nível de serviço (SLO) para a continuação dos negócios oferecido para o IBM Sterling Order Management System é de 4 horas para o objetivo de ponto de recuperação (RPO) e 8 horas para o objetivo de tempo de recuperação (RTO).
  • Além disso, se você comprar opções para a melhoria de SLO, o RPO esperado será 2 horas e o RTO será 4 horas.

Processo

Durante um desastre identificado, as etapas a seguir são concluídas como parte do processo de recuperação de desastre:
  1. No caso improvável de seu ambiente de Produção ou data center primário ter um problema grave, que, após a investigação, é considerado irreversível, a IBM declara que ocorreu um desastre. A IBM então começa a implementar o processo de recuperação de desastre.
  2. A IBM emitirá um alerta para você e para quaisquer outras partes relevantes, como seus parceiros de negócios, se você estiver usando um parceiro de negócios para suportar seus serviços
  3. A IBM ativa o processo de recuperação de desastre para alternar seu ambiente de Pré-produção para um ambiente de Produção temporário Quando o seu ambiente de Pré-produção está sendo usado como um ambiente de Produção temporário, o ambiente de Pré-Produção não está disponível Quando seu ambiente de Produção normal é restaurado, seu ambiente de Pré-produção torna-se disponível novamente

    Como parte dessa ativação, o IBM ativa os servidores de aplicativos de recuperação de desastre em seu código base de produção de backup. A IBM também valida se os sistemas de arquivo de rede para seu site estão montados e disponíveis

    Para disponibilizar seu site para usuários, a IBM desativa os servidores da web do ambiente de Produção dentro dos balanceadores de carga globais. A IBM então ativa os servidores da web de recuperação de desastre dentro dos balanceadores de carga globais. Quando esse comutador for concluído, o IBM notificará que seu site está disponível.

  4. Você e os seus parceiros de negócios podem realizar exercícios e testes de simulação de recuperação de desastre Para determinar como testar melhor seu processo de recuperação de desastre, trabalhe com a IBM para criar seu plano de teste e concluir seu teste.
    Verifique se suas funções e configurações do site funcionam em seu site da instância de recuperação de desastre ativo. Conclua as seguintes tarefas:
    • IBM Sterling Order Management System) Acesse a interface do usuário do aplicativo, incluindo quaisquer aplicativos de canal.
    • Teste a integridade de dados de seu banco de dados de recuperação de desastre Solicite consultas do banco de dados de recuperação de desastre para ajudar a validar a integridade de dados
    • Teste seu protocolo Telnet de rede para confirmar o caminho de rede
    • Conclua um processo de transação de pedido por meio de sua loja para seus sistemas backend no local que retornam dados ou confirmação do processo para sua loja. Assegure-se de planejar completamente esse processo de transação, pois ele pode inserir dados de pedido indesejados em seu sistema backend do cliente
  5. Seu ambiente de Produção é restaurado Se seu ambiente de Produção não puder ser restaurado, seu ambiente de Produção de recuperação de desastre se tornará seu ambiente de Produção permanente e um novo ambiente de Pré-produção será criado.

Limitações

Não é possível usar o ambiente de pré-produção quando seu ambiente de produção está no modo de recuperação de desastre Assegure-se de desativar quaisquer integrações que foram conectadas ao ambiente de Pré-produção enquanto o ambiente de Recuperação de Desastre está ativo...