Recuperação de desastre
O ambiente de Pré-produção é dimensionado para hospedar a instância regular do Sterling Order Management System (para tarefas de suporte de desempenho e produção) e a instância de DR inativa (como uma contingência). Ambas as instâncias compartilham máquinas virtuais para recursos de web, aplicativo e banco de dados. Durante um desastre declarado, a IBM coloca em quarentena o seu ambiente de Pré-produção, que é totalmente dedicado a restaurar a continuidade de negócios A arquitetura de recuperação de desastre inclui todos os servidores, rede, scripts e bancos de dados que estão envolvidos no backup de dados e comutadores entre os ambientes de Pré-produção e Produção, conforme necessário. O data center de Pré-Produção está alojado em um data center IBM® SoftLayer® diferente do data center do ambiente de Produção, geralmente em uma cidade ou localização geográfica diferente.
- Sem alterações nas URLs
- Durante a DR, seu ambiente de produção funciona temporariamente em nosso DC de pré-produção. No entanto, os mesmos URLs permanecem os mesmos e nenhuma ação é necessária da sua parte.
- Certificados
- Não há necessidade de adicionar novos certificados para o DC de pré-produção e todas as conexões continuam funcionando como agora.
- Lista de permissões da rede
- Esta é uma configuração única para evitar quaisquer problemas relacionados à rede durante a DR. Se a sua configuração de integração envolver a inclusão de intervalos de IP ou domínios na lista de permissões, certifique-se de que os data centers Prod e DR (PO) estejam na lista de permissões.
Os dados do ambiente de produção, incluindo dados da web e de aplicativos, são replicados e armazenados em backup por meio de uma rede privada IBM SoftLayer entre seus ambientes de produção e pré-produção. Seus bancos de dados de recuperação de desastres são sempre mantidos em um estado quase pronto, portanto, use essa rede para replicar dados em um modo quase síncrono usando a opção de recuperação de desastres de alta disponibilidade (HADR).
Objetivos de Nível de Serviço (SLO)
- O objetivo de nível de serviço (SLO) para a continuação dos negócios oferecido para o IBM Sterling Order Management System é de 4 horas para o objetivo de ponto de recuperação (RPO) e 8 horas para o objetivo de tempo de recuperação (RTO).
- Além disso, se você comprar opções para a melhoria de SLO, o RPO esperado será 2 horas e o RTO será 4 horas.
Processo
Durante um desastre identificado, as etapas a seguir são concluídas como parte do processo de recuperação de desastre:- No caso improvável de seu ambiente de Produção ou data center primário ter um problema grave, que, após a investigação, é considerado irreversível, a IBM declara que ocorreu um desastre. A IBM então começa a implementar o processo de recuperação de desastre.
- A IBM emitirá um alerta para você e para quaisquer outras partes relevantes, como seus parceiros de negócios, se você estiver usando um parceiro de negócios para suportar seus serviços
- A IBM ativa o processo de recuperação de desastre para alternar seu ambiente de Pré-produção para um ambiente de Produção temporário Quando o seu ambiente de Pré-produção está sendo usado como um ambiente de Produção temporário, o ambiente de Pré-Produção não está disponível Quando seu ambiente de Produção normal é restaurado, seu ambiente de Pré-produção torna-se disponível novamente
Como parte dessa ativação, o IBM ativa os servidores de aplicativos de recuperação de desastre em seu código base de produção de backup. A IBM também valida se os sistemas de arquivo de rede para seu site estão montados e disponíveis
Para disponibilizar seu site para usuários, a IBM desativa os servidores da web do ambiente de Produção dentro dos balanceadores de carga globais. A IBM então ativa os servidores da web de recuperação de desastre dentro dos balanceadores de carga globais. Quando esse comutador for concluído, o IBM notificará que seu site está disponível.
- Você e os seus parceiros de negócios podem realizar exercícios e testes de simulação de recuperação de desastre Para determinar como testar melhor seu processo de recuperação de desastre, trabalhe com a IBM para criar seu plano de teste e concluir seu teste.Verifique se suas funções e configurações do site funcionam em seu site da instância de recuperação de desastre ativo. Conclua as seguintes tarefas:
- IBM Sterling Order Management System) Acesse a interface do usuário do aplicativo, incluindo quaisquer aplicativos de canal.
- Teste a integridade de dados de seu banco de dados de recuperação de desastre Solicite consultas do banco de dados de recuperação de desastre para ajudar a validar a integridade de dados
- Teste seu protocolo Telnet de rede para confirmar o caminho de rede
- Conclua um processo de transação de pedido por meio de sua loja para seus sistemas backend no local que retornam dados ou confirmação do processo para sua loja. Assegure-se de planejar completamente esse processo de transação, pois ele pode inserir dados de pedido indesejados em seu sistema backend do cliente
- Seu ambiente de Produção é restaurado Se seu ambiente de Produção não puder ser restaurado, seu ambiente de Produção de recuperação de desastre se tornará seu ambiente de Produção permanente e um novo ambiente de Pré-produção será criado.
Limitações
Não é possível usar o ambiente de pré-produção quando seu ambiente de produção está no modo de recuperação de desastre Assegure-se de desativar quaisquer integrações que foram conectadas ao ambiente de Pré-produção enquanto o ambiente de Recuperação de Desastre está ativo...