Determinar si la clasificación es apropiada para el entorno de almacenamiento

Antes de clasificar los datos del almacenamiento de disco en agrupaciones de almacenamiento de contenedores de directorio en almacenamiento de nube, cinta o archivos, revise la información sobre los tipos de almacenamiento y determine qué tipo se ajusta mejor a sus requisitos empresariales. En general, la nube y la cinta son adecuadas para el almacenamiento a largo plazo de datos a los que se accede con poca frecuencia y que no requieren una recuperación rápida. El almacenamiento de archivos es adecuado para datos a los que ya no es necesario deduplicar, pero a los que se puede seguir accediendo con frecuencia.

Analice las ventajas y desventajas de cada tipo de almacenamiento:

Almacenamiento de disco en agrupaciones de almacenamiento de contenedor de directorios
El almacenamiento de disco en agrupaciones de almacenamiento de contenedor de directorios (más adelante denominado almacenamiento de disco) es útil para los datos a los que se debe acceder con frecuencia y que se deben recuperar rápidamente. Sin embargo, el almacenamiento de disco suele ser más costoso que el almacenamiento en la nube o en la cinta. Por esta razón, algunos usuarios clasifican sus datos en cloud o almacenamiento en cinta para lograr un ahorro de espacio y reducir costes. La cantidad de ahorro de espacio depende de la forma en que los datos se deduplican en el disco. Si los datos se deduplican eficazmente en el disco, puede que no logre los ahorros de espacio previstos con la clasificación de los datos.
Sugerencia: Para determinar si los datos se deduplican de forma efectiva en el disco, realice una de las acciones siguientes:
  • Genere estadísticas de deduplicación de datos de datos utilizando el mandato GENERATE DEDUPSTATS. A continuación, visualice las estadísticas utilizando el mandato QUERY DEDUPSTATS.
  • Desde el cliente administrativo, ejecute el mandato SELECT * from SUMMARY. Para ver ejemplos, consulte la nota técnica 3121257.
En general, si la proporción de deduplicación de datos es 4:1 o mejor, los datos se deduplican con eficacia. Por ejemplo, si dispone de 100 KB de datos y reduce el tamaño a 25 KB, la deduplicación se considera eficaz. Si la proporción es menor que 4:1, la deduplicación no es eficiente.
Si los datos del almacenamiento de disco no se deduplican con eficacia y no hay necesidad de recuperar rápidamente los datos, considere la posibilidad de guardar los datos en el almacenamiento en la nube o en la cinta con frecuencia con un breve retardo de la información.
Almacenamiento en la nube
El almacenamiento en la nube puede ser más escalable y rentable que el almacenamiento de disco. Sin embargo, el tiempo necesario para recuperar los datos de la nube suele ser más largo que el disco. Para el cloud tiering, debe encontrar un proveedor de cloud que utilice el sistema de cloud computing Microsoft Azure o un sistema de cloud computing que utilice el protocolo Simple Storage Service ( S3 ), como IBM Cloud® Object Storage o el Amazon Simple Storage Service ( Amazon S3 ). Para obtener la información más reciente sobre los servicios de almacenamiento de objetos en la nube que están soportados, consulte la nota técnica 2000915.
Almacenamiento en cinta
El almacenamiento en cinta puede ser más escalable y rentable que el almacenamiento de disco, pero el tiempo necesario para recuperar los datos de la cinta normalmente es más largo que el disco. En el caso de cargas de trabajo de archivos pequeños (con un tamaño de archivo medio de 50 KB o más), el proceso de clasificación de datos en cinta puede llevar más tiempo que lo que permite una ventana de clasificación típica. También debe tener en cuenta el esfuerzo que se necesita para compartir unidades de cintas y coordinar el acceso a los volúmenes de cinta.
Sugerencia: Para calcular el tamaño promedio de archivo, utilice el procesador de línea de mandatos de IBM Db2 para ejecutar los mandatos siguientes:
db2 "connect to tsmdb1"
db2 "set schema tsmdb1"
db2 "select avg(logical_size) from sc_all_objects for read only with ur
Almacenamiento de archivos
El almacenamiento de archivos significa que los datos se almacenan en una agrupación de almacenamiento de acceso secuencial con un tipo de dispositivo FILE y la agrupación de almacenamiento está en disco. El almacenamiento de archivos en disco suele ser más caro que el almacenamiento en nube o en cinta. Sin embargo, el almacenamiento de archivos en disco ofrece las ventajas siguientes:
  • Puede utilizar los mandatos EXPORT y IMPORT para mover los datos de un sistema a otro.
  • Si los datos se almacenan en una agrupación de almacenamiento de contenedores de directorios donde los datos se deduplican automáticamente, puede interrumpir la deduplicación de datos para un nodo determinado mediante la clasificación de los datos en el almacenamiento de archivos, donde la deduplicación de datos está inhabilitada de forma predeterminada.
Antes de clasificar los datos en cinta, revise el siguiente diagrama de flujo. Es posible que las condiciones del diagrama de flujo no se apliquen a todos los entornos de almacenamiento. Las consideraciones adicionales, que no están en el diagrama de flujo, pueden influir en la decisión. Tome la decisión que le ayude a cumplir los requisitos de su empresa.
El diagrama de flujo refleja los siguientes puntos de decisión: 1. Si los datos se deben recuperar rápidamente, puede que no sea conveniente clasificar los datos en cinta. 2. Si la deduplicación de datos en disco es altamente satisfactoria, puede que la clasificación de datos en cinta no le ayude a lograr el ahorro de espacio esperado. 3. Si se debe acceder a los datos con frecuencia, puede que la clasificación de datos en cinta no sea adecuada porque el acceso a los datos desde el disco suele ser más rápido. 4. Si los datos incluyen muchos archivos pequeños, la clasificación de datos en cinta podría no ser adecuada porque las operaciones de clasificación podrían ser lentas. Sin embargo, si no se cumple ninguna de las condiciones listadas anteriormente, la clasificación de datos en cinta puede ayudar a optimizar el almacenamiento y reducir los costes. Debe equilibrar las ventajas con el esfuerzo adicional asociado con la compartición de unidades de cintas y la coordinación del acceso a los volúmenes de cinta.
Restricción: utilizando el protocolo Amazon S3 , puede enviar datos desde IBM Storage Protect Plus y otros clientes de objetos a IBM Storage Protect. Los datos enviados se conocen como datos de cliente de objeto. No puede clasificar datos de cliente de objeto en cinta.
Si decide clasificar los datos en la nube, cinta o archivo, también debe seleccionar una opción de clasificación. Las opciones siguientes están disponibles:
Clasificar datos por edad
Cuando los datos alcanzan un umbral de antigüedad especificado, los datos se pueden clasificar.
Sugerencia: En Operations Center, para clasificar los datos por antigüedad, especifique la opción Todos los datos .
Clasificar datos por estado
Cuando los datos alcanzan un umbral de antigüedad especificado, sólo se clasifican los datos inactivos.
Sugerencia: En Operations Center, para clasificar los datos por estado, especifique la opción Datos inactivos .
Para seleccionar una opción de clasificación, revise el diagrama de flujo.
El diagrama de flujo muestra los tipos de cliente y describe cómo clasificar los datos para cada tipo de cliente. Cliente de archivado y copia de seguridad de IBM Spectrum Protect™ : para datos a los que se accede con frecuencia, nivel por estado. Para datos a los que se accede poco, clasifique por edad. IBM Spectrum Protect for Databases: Data Protection for Microsoft SQL Server: para datos a los que se accede con frecuencia, nivel por estado. Para datos a los que se accede poco, clasifique por edad. IBM Spectrum Protect for Databases: Data Protection for Oracle: para todos los datos, nivel por antigüedad. IBM Spectrum Protect for Databases: Data Protection for SAP: para todos los datos, especifique cualquiera de las opciones; en ambos casos, los datos se clasifican por antigüedad. IBM Spectrum Protect HSM for Windows: para todos los datos, especifique cualquiera de las opciones; en ambos casos, los datos se clasifican por antigüedad. IBM Spectrum Protect for Mail: Data Protection for IBM Domino: para los datos a los que se accede con frecuencia, nivel por estado. Para datos a los que se accede poco, clasifique por edad. IBM Spectrum Protect for Mail: Data Protection for Microsoft Exchange Server: para los datos a los que se accede con frecuencia, nivel por estado. Para datos a los que se accede poco, clasifique por edad. IBM Spectrum Protect for Space Management: para todos los datos, clasifique por antigüedad. IBM Spectrum Protect for Virtual Environments: para entornos de producción, no clasifique los datos. Para entornos de prueba y desarrollo, clasifique los datos por edad. IBM Spectrum Protect Plus: para todos los datos, clasifique por edad.
Restricción: Cuando clasifique los datos en la nube, cinta o almacenamiento de archivos, el proceso de clasificación excluye automáticamente los metadatos que normalmente se recuperan para las operaciones de copia de seguridad posteriores. Normalmente, estos metadatos constan de archivos de control, que se recuperan durante las operaciones de copia de seguridad del cliente para determinar qué archivos de datos o bloques deben enviarse al servidor de IBM Storage Protect . Por ejemplo, cuando realiza una copia de seguridad de los archivos IBM Storage Protect for Virtual Environments , los archivos de control se generan con información de diseño de datos. No puede clasificar los archivos de control en la nube, cinta o almacenamiento de archivos.

Para obtener directrices más detalladas, consulte Directrices detalladas sobre clasificación por edad frente a clasificación por estado.