Planificación de agrupaciones de almacenamiento de contenedores de nubes y contenedores de directorios

Revise cómo se configura el servidor para garantizar un rendimiento óptimo cuando se utilizan agrupaciones de almacenamiento de contenedores de directorio y contenedor de nube.

Pregunta Tareas, características, opciones o valores Más información
Medido en términos de operaciones de entrada/salida por segundo (IOPS), ¿está utilizando almacenamiento de disco rápido para la base de datos de IBM Storage Protect ?

Utilice un disco de alto rendimiento para la base de datos. Utilice la tecnología de unidad de estado sólido para el procesamiento de deduplicación de datos.

Asegúrese de que la base de datos tenga una capacidad mínima de 3000 IOPS. Por cada TB de datos del que se realice copia de seguridad a diario (antes de la deduplicación y la compresión de datos), incluya 1000 IOPS adicionales a este mínimo.

Por ejemplo:
  • Para la ingesta diaria de datos de 1 TB, el servidor necesita 4000 IOPS.
  • Para la ingesta diaria de datos de 10 TB, el servidor necesita 13000 IOPS.
  • Para la ingesta diaria de datos de 10 TB a 30 TB, el servidor necesita de 13000 a 33000 IOPS.
  • Para la ingesta diaria de datos de 30 TB a 100 TB, el servidor necesita de 33000 IOPS a 100300 IOPS.
3000 IOPS minimum + 30000 (30 
TB x 1000 IOPS) = 33000 IOPS
Para obtener recomendaciones sobre la selección de discos, consulte Planificación de discos de base de datos de servidor.

Para más información sobre IOPS, consulte IBM® Storage Protect Blueprints y localice el Blueprint correspondiente a su sistema operativo.

¿Tiene suficiente memoria para el tamaño de su base de datos? Utilice un mínimo de 40 GB de memoria del sistema para servidores IBM Storage Protect , con un tamaño de base de datos de 100 GB, que están deduplicando datos. Si la capacidad retenida de los datos de copia de seguridad aumenta, el requisito de memoria podría tener que ser mayor.

Supervise regularmente la utilización de memoria para determinar si se necesita más memoria.

Utilice más memoria del sistema para mejorar el almacenamiento en memoria caché de las páginas de base de datos. Las siguientes directrices de tamaño de memoria se basan en la cantidad diaria de datos nuevos de los que se realiza una copia de seguridad:
  • Para el consumo diario de datos de hasta 1 TB, necesita de 16 a 24 GB de memoria.
  • Para la ingesta diaria de datos de hasta 10 TB, necesita 64 GB de memoria.
  • Para la ingesta diaria de datos de 10 a 30 TB, necesita 192 GB de memoria.
  • Para la ingesta diaria de datos de hasta 100 TB, necesita 384 GB de memoria.
Requisitos de memoria
¿Ha calculado correctamente la capacidad de almacenamiento para el registro activo de la base de datos y el registro de archivado?

Configure el servidor para que tenga un tamaño de registro activo mínimo de 128 GB estableciendo la opción de servidor ACTIVELOGSIZE en un valor de 131072.

El tamaño inicial recomendado para el registro de archivado es 1 TB. El tamaño del registro de archivado está limitado por el tamaño del sistema de archivos en el que está ubicado, no por una opción del servidor. Asegúrese de que haya al menos un 10% de espacio de disco adicional respecto al tamaño del registro de archivado para el sistema de archivos.

Utilice un directorio para los registros de archivado de base de datos con una capacidad libre inicial de al menos 1 TB. Especifique el directorio utilizando la opción de servidor ARCHLOGDIRECTORY.

Defina el espacio para el registro de migración tras error utilizando la opción de servidor ARCHFAILOVERLOGDIRECTORY.

Para obtener más información sobre el dimensionamiento del sistema, consulte IBM Storage Protect Blueprints y localice el Blueprint del sistema operativo.

¿Está habilitada la compresión para el registro de archivado y las copias de seguridad de la base de datos? Habilite la opción de servidor ARCHLOGCOMPRESS para ahorrar espacio de almacenamiento.

Esta opción de compresión es diferente de la compresión en línea. La compresión en línea está habilitada de forma predeterminada con IBM Storage Protect 7.1.5 y posterior.

Restricción: No utilice esta opción si la cantidad de datos de copia de seguridad supera los 6 TB por día.

Para obtener más información sobre la compresión para el sistema, consulte IBM Storage Protect Blueprints y localice el Blueprint para el sistema operativo.

¿La base de datos y los registros de IBM Storage Protect están en volúmenes de disco separados (LUN)?

¿Se ha configurado el disco que se utiliza para la base de datos de acuerdo con los métodos recomendados de una base de datos transaccional?

La base de datos no debe compartir volúmenes de disco con registros de base de datos o agrupaciones de almacenamiento de IBM Storage Protect , ni con ninguna otra aplicación o sistema de archivos.

Para obtener más información sobre la configuración del registro de recuperación y la base de datos del servidor, consulte Configuración y ajuste del registro de recuperación y la base de datos del servidor.
¿Está utilizando un mínimo de ocho núcleos de procesador (2.2 GHz o equivalente) para cada servidor IBM Storage Protect que tiene previsto utilizar con la eliminación de datos duplicados? Si tiene pensado utilizar la deduplicación de datos del lado del cliente, compruebe que los sistemas cliente tengan suficientes recursos disponibles durante una operación de copia de seguridad para completar el procesamiento de deduplicación de datos. Utilice un procesador que tenga al menos el mínimo equivalente a un núcleo de procesador de 2,2 GHz por proceso de copia de seguridad con la eliminación de datos duplicados del lado del cliente.
¿Ha asignado suficiente espacio de almacenamiento para la base de datos? Como estimación aproximada, cuente con 100 GB de almacenamiento de base de datos por cada 25 TB de datos que se vayan a proteger en las agrupaciones de almacenamiento deduplicadas. Datos protegidos es la cantidad de datos antes de la deduplicación, incluidas todas las versiones de objetos almacenados.

Para las operaciones de copia de seguridad de bases de datos con una gran cantidad de archivos pequeños, donde el tamaño medio del archivo sea inferior a 512 KB, necesitará más espacio de base de datos. Para objetos de menor tamaño, cuente con 100 GB de espacio de base de datos por cada 10 TB almacenados.

Como práctica recomendada, defina una nueva agrupación de almacenamiento de contenedores exclusivamente para deduplicación de datos. La deduplicación de datos se lleva a cabo en el nivel de la agrupación de almacenamiento y se deduplican todos los datos de una agrupación de almacenamiento, excepto los datos cifrados.

El entorno óptimo de IBM Storage Protect se configura utilizando IBM Storage Protect Blueprints.
¿Ha estimado la capacidad de la agrupación de almacenamiento y ha configurado un espacio basado en el tamaño del entorno? Puede calcular los requisitos de capacidad de una agrupación de almacenamiento deduplicado utilizando la siguiente técnica:
  1. Estime el tamaño base de los datos de origen.
  2. Estime el tamaño de la copia de seguridad diaria utilizando una tasa estimada de crecimiento y cambio.
  3. Determine los requisitos de retención.
  4. Estime la cantidad total de datos de origen teniendo en cuenta el tamaño base, el tamaño de copia de seguridad diario y los requisitos de retención.
  5. Aplique el factor de proporción de la optimización de almacenamiento.
  6. Aplique el factor de proporción de compresión.
  7. Incremente la estimación para tener en cuenta el uso de la agrupación de almacenamiento transitoria.

Para ver un ejemplo de utilización de esta técnica, consulte FAQ de deduplicación de datos.

¿Ha distribuido la E/S de disco en varios dispositivos de disco y controladores? Utilice matrices con tantos discos como sea posible, a lo que en ocasiones se denomina escritura en bandas amplia. Asegúrese de que utiliza un directorio de base de datos por cada matriz en el subsistema.

Establezca la variable de registro DB2_PARALLEL_IO para habilitar la E/S paralela para cada espacio de tabla utilizado si los contenedores del espacio de tabla abarcan varios discos físicos.

Cuando el ancho de banda de E/S está disponible y los archivos son grandes, por ejemplo de 1 MB, el proceso de encontrar duplicados puede ocupar los recursos de todo un procesador. Si los archivos son más pequeños, se pueden producir otros cuellos de botella.

Utilice las directrices siguientes para crear sistemas de archivos:
  • Para la ingesta diaria de datos de menos de 10 TB, necesita 8 o más sistemas de archivos.
  • Para la ingesta diaria de datos de 10 TB a 30 TB, necesita 12 o más sistemas de archivos.
  • Para la ingesta diaria de datos de hasta 100 TB, necesita 32 o más sistemas de archivos.
Para obtener directrices sobre la configuración de agrupaciones de almacenamiento, consulte Planificación de agrupaciones de almacenamiento en clases de dispositivo DISK o FILE.

Para obtener información sobre cómo establecer la variable DB2_PARALLEL_IO , consulte Valores recomendados para las variables de registro de IBM DB2®.

¿Ha planificado las operaciones diarias en función de su estrategia de copia de seguridad?
La secuencia recomendada de operaciones está en el siguiente orden:
  1. Copia de seguridad del cliente
  2. Protección de agrupación de almacenamiento
  3. Réplica de datos
  4. Copia de seguridad de base de datos
  5. Caducar inventario
¿Ha planificado operaciones de auditoría para identificar archivos dañados en agrupaciones de almacenamiento? Para planificar operaciones de auditoría, utilice el mandato DEFINE STGRULE y especifique el parámetro ACTIONTYPE=AUDIT.

Se recomienda, para garantizar que las operaciones de auditoría se ejecuten continuamente, no especificar el parámetro DELAY.

 
¿Tiene suficiente almacenamiento para gestionar la lista de bloqueos de IBM Db2 ? Si deduplica datos que incluyan grandes archivos o grandes números de archivos simultáneamente, el proceso podría producir espacio de almacenamiento insuficiente. Si el almacenamiento de la lista de bloqueos es insuficiente, pueden producirse errores de copia de seguridad, errores de proceso de gestión de datos o caídas de servidor.

Los tamaños de archivo superiores a 500 GB que se procesen por deduplicación de datos tienen más probabilidad de agotar el espacio de almacenamiento. No obstante, si muchas operaciones de copia de seguridad utilizan deduplicación de datos del lado del cliente, este problema también puede producirse con archivos de tamaño más pequeño.

Para obtener información sobre el ajuste del parámetro Db2 LOCKLIST , consulteAjuste de la eliminación de duplicados de datos del lado del servidor
¿Hay suficiente ancho de banda disponible para transferir datos a un servidor de IBM Storage Protect ? Para transferir datos a un servidor IBM Storage Protect , utilice la deduplicación y compresión de datos del lado del cliente o del lado del servidor para reducir el ancho de banda necesario. Para obtener más información, consulte la opción de cliente enablededup.
¿Ha determinado cuántos directorios de agrupación de almacenamiento asignar a cada agrupación de almacenamiento? Asigne directorios a una agrupación de almacenamiento utilizando el mandato DEFINE STGPOOLDIRECTORY.

Cree varios directorios de agrupación de almacenamiento y asegúrese de que se haya realizado una copia de seguridad de cada directorio en un volumen de disco (LUN) independiente.

 
¿Ha asignado suficiente espacio de disco en la agrupación de almacenamiento de contenedor de nube?
Para impedir anomalías de copia de seguridad, asegúrese de que el directorio local tiene suficiente espacio. Utilice la siguiente lista como guía para el espacio de disco óptimo:
  • Para disco SCSI con conexión en serie (SAS) y giratorio, calcule la cantidad de datos nuevos que se esperan después de la reducción de datos diaria (compresión y deduplicación de datos). Como máximo asigne el 100 por cien de esa cantidad, en terabytes, para el espacio de disco.
  • Para sistemas basados en Flash o SSD con conexiones de red rápidas a sistemas cloud de alto rendimiento, consulte IBM Storage Protect Blueprints para obtener las últimas directrices sobre recomendaciones de disco.
 
¿Ha hecho un test de referencia del rendimiento de la memoria caché de nube de la agrupación de contenedores de nube?

Para evitar las zonas activas de disco, asegúrese de que el directorio local tenga un único directorio de agrupación de almacenamiento y un sistema de archivos para la memoria caché de nube.

Para obtener más información sobre la optimización de las operaciones de copia de seguridad, consulte Dimensionamiento de una memoria caché en la nube para optimizar las operaciones de copia de seguridad.
¿Ha seleccionado el tipo apropiado de almacenamiento local?
Asegúrese de que las transferencias de datos del almacenamiento local a nube finalizan antes de que se inicie el siguiente ciclo de copia de seguridad.
Sugerencia: Los datos se eliminan del almacenamiento local poco después de que se muevan a la nube.
Utilice las directrices siguientes:
  • Utilice flash o SSD para sistemas grandes que tienen sistemas en nube de alto rendimiento. Asegúrese de tener un enlace de red de área amplia (WAN) dedicada de 10 GB con una conexión de alta velocidad al almacenamiento de objeto. Por ejemplo, utilice flash o SSD si tiene un enlace WAN de 10 GB dedicado más una conexión de alta velocidad a una ubicación de IBM Cloud Object Storage o a un centro de datos de Amazon Simple Storage Service (Amazon S3).
  • Utilice discos SAS de 15000 rpm de mayor capacidad para estos escenarios:
    • Sistemas de tamaño medio
    • Conexiones de tipo nube más lentas, por ejemplo 1 GB
    • Cuando utiliza IBM Cloud Object Storage como proveedor de servicios en varias regiones
  • Para el disco SAS o giratorio, calcule la cantidad de datos nuevos que se esperan después de la reducción de datos diaria (compresión y deduplicación de datos). Como máximo asigne el 100 por cien de esa cantidad para el espacio de disco, en terabytes.
 
Para las agrupaciones de almacenamiento de contenedor de nube, ¿ha especificado el número máximo total de procesos paralelos para la regla de niveles de almacenamiento y cada una de sus subreglas? Para especificar el número máximo de procesos paralelos, emita el mandato DEFINE STGRULE y especifique el parámetro MAXPROCESS. El valor predeterminado es 8. Por ejemplo, si se especifica el valor predeterminado de 8, y la regla de almacenamiento tiene cuatro subreglas, la regla de almacenamiento puede ejecutar ocho procesos paralelos y cada una de sus subreglas puede ejecutar ocho procesos paralelos.
Para conseguir el mejor rendimiento, utilice el siguiente número máximo de procesos paralelos para sistemas Blueprint pequeños, medianos y grandes:
  • Sistema pequeño: 10 procesos
  • Sistema mediano: 25 procesos
  • Sistema grande: 35-50 procesos
 
Para las agrupaciones de almacenamiento de contenedores de nube, ¿ha definido varios puntos finales de Accesser si está utilizando un sistema IBM Cloud Object Storage local con IBM Storage Protect? Para optimizar el rendimiento, defina el acceso para el siguiente número de Accessers para sistemas blueprint pequeños, medianos y grandes, en función de los requisitos de ingesta de datos:
  • Sistema pequeño: 1 Accesser
  • Sistema medio: 2 Accessers
  • Sistema grande: 3-4 Accessers
Para obtener más información, consulte IBM Storage Protect Cloud Blueprints.
Para las agrupaciones de almacenamiento de contenedor en la nube, ¿ha definido varios puntos finales de Accesser si está utilizando un sistema IBM Cloud Object Storage local con IBM Storage Protect?
Generalmente, se necesita la siguiente capacidad Ethernet para conectarse a puntos finales privados de IBM Cloud Object Storage para sistemas Blueprint pequeños, medianos y grandes:
  • Sistema pequeño: 1 Gbit
  • Sistema mediano: 5 Gbit
  • Sistema grande: 10 Gbit
Sugerencia: Dependiendo de la ingesta de datos del cliente y de la transferencia simultánea de datos al almacenamiento de objetos, es posible que necesite más de una red Ethernet de 10 Gbit.
Cuando configure la conexión Ethernet, utilice un administrador de red y tenga en cuenta los factores siguientes:
  • La prestación Ethernet del servidor
  • La naturaleza de la red entre el servidor y el punto final IBM Cloud Object Storage
  • El punto de incorporación final en el almacenamiento de objetos a través de una agrupación de almacenamiento de contenedor en la nube