Determinando se a colocação em camadas é apropriada para seu ambiente de armazenamento

Antes de você colocar em camadas dados do armazenamento em disco em conjuntos de armazenamento de contêiner de diretório para nuvem, fita ou armazenamento de arquivos, revise as informações sobre os tipos de armazenamento e determine qual tipo melhor atende aos seus requisitos de negócio. Em geral, dispositivos de nuvem e de fita são adequados para o armazenamento de longo prazo de dados que não são acessados com muita frequência e que não requerem rápida recuperação. O armazenamento de arquivos é apropriado para dados que não precisam mais ser deduplicados mas que ainda podem ser acessados com frequência.

Considere as vantagens e desvantagens de cada tipo de armazenamento:

Armazenamento em disco em conjuntos de armazenamento de contêiner de diretório
O armazenamento em disco em conjuntos de armazenamentos de contêiner de diretório (posteriormente referido como armazenamento em disco) é útil para dados que devem ser acessados com frequência e recuperados rapidamente. No entanto, o armazenamento em disco geralmente é mais caro que o armazenamento em nuvem ou em fita. Por isso, alguns usuários colocam seus dados em camadas em armazenamentos de nuvem ou de fita, economizando espaço e reduzindo custos. O valor da economia de espaço depende de quão bem os dados são deduplicados em disco. Se os dados forem deduplicados de forma eficiente em disco, será possível que você não atinja a economia de espaço esperada ao colocar os dados em camadas.
Dica: Para determinar se os dados são efetivamente deduplicados em disco, pegue uma das seguintes ações:
  • Gerar estatísticas de deduplicação de dados usando o comando GENERATE DEDUPSTATS . Em seguida, visualize as estatísticas usando o comando QUERY DEDUPSTATS.
  • A partir do cliente administrativo, execute o comando SELECT * from SUMMARY . Para obter exemplos, consulte a nota técnica 3121257
Em geral, se a razão de deduplicação de dados for 4:1 ou melhor, os dados serão eficientemente deduplicados. Por exemplo, se você tiver 100 KB de dados e reduzir o tamanho para 25 KB, a deduplicação de dados será considerada eficiente. Caso a taxa seja inferior a 4:1, a deduplicação não é eficiente.
Se os dados no armazenamento em disco não forem deduplicados de forma eficiente e não houver nenhum requisito para recuperar rapidamente os dados, considere colocar os dados em camadas no armazenamento em nuvem ou em fita frequentemente com um breve atraso de colocação em camadas.
Armazenamento em nuvem
O armazenamento em nuvem pode ser mais escalável e eficaz em termos de custo do que o armazenamento em disco. No entanto, o tempo que é necessário para recuperar dados da nuvem em geral é mais longo do que do disco. Para a classificação em camadas na nuvem, você deve encontrar um provedor de nuvem que use o sistema de computação em nuvem Microsoft Azure ou um sistema de computação em nuvem que use o protocolo Simple Storage Service ( S3 ), como IBM Cloud® Object Storage ou Amazon Simple Storage Service ( Amazon S3 ). Para obter as informações mais recentes sobre serviços de armazenamento de objeto de nuvem que são suportados, consulte nota técnica 2000915.
Armazenamento em Fita
O armazenamento em fita pode ser mais escalável e eficaz em termos de custo do que o armazenamento em disco, mas o tempo necessário para recuperar os dados da fita em geral é mais longo do que do disco. Para pequenas cargas de trabalho de arquivo (com um tamanho médio de arquivo de 50 KB ou menor), o processo de colocação em camadas de dados para fita pode levar mais tempo do que uma janela típica de camadas permite. Deve-se considerar também o esforço que é necessário para compartilhar unidades de fita e coordenar o acesso a volumes de fita.
Dica: para calcular o tamanho médio do arquivo, use o IBM Db2 Command Line Processor para executar os comandos a seguir:
db2 "connect to tsmdb1"
db2 "set schema tsmdb1"
db2 "select avg(logical_size) from sc_all_objects for read only with ur
Armazenamento de arquivo
Armazenamento de arquivos significa que os dados são armazenados em um conjunto de armazenamento de acesso sequencial com um tipo de dispositivo FILE, e o conjunto de armazenamento está em disco. O armazenamento de arquivos em disco é tipicamente mais caro do que o armazenamento em nuvem ou fita. No entanto, o armazenamento de arquivos em disco oferece as vantagens a seguir:
  • É possível usar os comandos EXPORT e IMPORT para mover os dados de um sistema para outro.
  • Se os dados forem armazenados em um conjunto de armazenamento de contêiner de diretório no qual os dados são automaticamente deduplicados, é possível descontinuar a deduplicação de dados para um determinado nó, colocando em camadas os dados para o armazenamento de arquivos, em que a deduplicação de dados é desativada por padrão.
Antes de colocar os dados em camadas em fitas, revise o fluxograma a seguir. As condições no fluxograma podem não se aplicar a todos os ambientes de armazenamento. Sua decisão pode ser influenciada por outros fatores, não demonstrados no fluxograma. Escolha a opção que o ajuda a atender às suas necessidades de negócios.
O fluxograma reflete os seguintes pontos de decisão: 1. Se for necessário recuperar os dados rapidamente, colocar os dados em camadas na fita poderá não ser apropriado. 2. Se a deduplicação de dados em disco for altamente bem-sucedida, colocar dados em camadas na fita poderá não ajudar a atingir a economia de espaço esperada. 3. Se for necessário acessar os dados com frequência, colocar dados em camadas na fita poderá não ser apropriado porque acessar dados do disco normalmente é mais rápido. 4. Se os dados incluem muitos arquivos pequenos, a criação de camadas de dados para fita pode não ser apropriado porque as operações de criação de camadas podem ser lentas. No entanto, se nenhuma das condições listadas anteriormente for verdadeira, o armazenamento de dados em camadas em fitas pode ajudar a otimizar o espaço e reduzir custos. Você deve equilibrar os benefícios contra o esforço adicional que está associado ao compartilhamento de unidades de fita e coordenar o acesso a volumes de fita.
Restrição: usando o protocolo Amazon S3 , é possível enviar dados do IBM Storage Protect Plus e de outros clientes de objeto para o IBM Storage Protect. Os dados enviados são conhecidos como dados do cliente de objeto. Não é possível colocar os dados do cliente de objeto em camadas na fita.
Se você decidir colocar dados em camadas para nuvem, fita ou arquivo, deve-se também selecionar uma opção de criação de camadas. As seguintes opções estão disponíveis:
Camada de dados por idade
Quando os dados atendem a um limite de idade especificado, eles são colocados em camadas.
Dica: no Operations Center, para colocar dados em camadas por idade, especifique a opção Todos os dados .
Definição de camada por estado
Quando os dados atendem a um limite de idade especificado, apenas os dados inativos são colocados em camadas.
Dica: no Operations Center, para colocar dados em camadas por estado, especifique a opção Dados inativos .
Para selecionar uma opção de criação de camadas, revise o fluxograma.
O fluxograma retrata tipos de clientes e descreve como camada de dados para cada tipo de cliente. Cliente
de backup e archive IBM Spectrum Protect™: para os dados acessados frequentemente, defina em camada por estado. Para os dados não acessados frequentemente, a camada é feita por estado. IBM Spectrum Protect for Databases: Data Protection for
Microsoft SQL Server: para os dados acessados frequentemente, defina em camada por estado. Para os dados não acessados frequentemente, a camada é feita por estado. IBM Spectrum Protect for Databases: Data Protection for Oracle: para todos os dados, defina em camada por
idade. IBM Spectrum Protect for Databases: Data Protection for SAP: para todos os dados, especifique qualquer
uma das opções; em ambos os casos, os dados são definidos em camada por idade. IBM Spectrum Protect HSM for Windows: para todos os dados,
especifique qualquer uma das opções; em ambos os casos, os dados são definidos em camada por idade. IBM Spectrum Protect for Mail: Data
Protection for IBM Domino: para os dados acessados frequentemente, defina em camada por estado. Para os dados não acessados frequentemente, a camada é feita por estado. IBM Spectrum Protect for Mail: Data Protection for Microsoft Exchange Server: para
os dados acessados frequentemente, defina em camada por estado. Para os dados não acessados frequentemente, a camada é feita por estado. IBM Spectrum
Protect for Space Management: para todos os dados, defina em camada por idade. IBM Spectrum Protect for Virtual
Environments: para ambientes de produção, não defina os dados em camada. Para ambientes de teste e de desenvolvimento, defina os dados em camada por idade. IBM Spectrum Protect Plus: para todos os dados, camada por idade.
Restrição: Quando você tier dados para nuvem, fita ou armazenamento de arquivos, o processo de tiering exclui automaticamente metadados que são comumente chamados para operações de backup subsequentes. Geralmente, esses metadados consistem em arquivos de controle, que são rechamados durante as operações de backup do cliente para determinar quais arquivos de dados ou blocos devem ser enviados para o servidor IBM Storage Protect Por exemplo, ao fazer backup de arquivos IBM Storage Protect for Virtual Environments , os arquivos de controle são gerados com informações de layout de dados. Não é possível colocar em camadas os arquivos de controle para nuvem, fita ou armazenamento de arquivos.

Para obter diretrizes mais detalhadas, consulte Diretrizes Detalhadas sobre definição de camada por idade versus definição de camada por estado