Options de dédoublonnage de données

Utilisez le dédoublonnage de données en ligne pour dédoublonner des données et les écrire simultanément dans un pool de stockage de conteneur. Utilisez le dédoublonnage de données post-traitement pour éliminer les données en double des pools de stockage (FILE) à accès séquentiel.

Astuce: Bien que le dédoublonnage de données soit disponible pour les pools de stockage à accès séquentiel (FILE), il est préférable d'utiliser des pools de stockage de conteneur de répertoire et de conteneur cloud car ces types de pool de stockage offrent des technologies plus récentes pour le stockage de données. Les données stockées dans les pools de stockage de conteneur cloud ou de conteneur de répertoire utilisent soit le dédoublonnage de données en ligne, soit le dédoublonnage de données coté client.

Vous devez utiliser des pools de stockage de conteneur de répertoire ou des pools de stockage de conteneur cloud pour le dédoublonnage de données en ligne. Si vous utilisez des pools de stockage de conteneur de répertoire ou des pools de stockage de conteneur cloud, vous réduisez la nécessité d'une réorganisation hors ligne, ce qui permet d'améliorer les performances du serveur et de réduire les coûts en matériel de stockage. Vous n'utilisez pas de classes de périphériques ou de volumes avec ces types de pool de stockage.

Lorsque le dédoublonnage de données post-traitement est utilisé, le serveur identifie d'abord les données, puis retire les données en double du pool de stockage. Une seule instance des données est conservée sur le support de stockage. Les autres instances de ces mêmes données sont remplacées par un pointeur dans l'instance conservée. Lorsque vous retirez les données en double, vous pouvez récupérer de l'espace dans le pool de stockage.

Pour plus d'informations sur le dédoublonnage de données post-traitement, voir Dédoublonnage de données (V7.1.1).

Au cours du processus de dédoublonnage de données côté client, seules les données compressées et dédoublonnées sont envoyées au serveur. Le traitement est distribué entre le serveur et le client durant un processus de sauvegarde.

Utilisez la table ci-dessous pour comparer les options de dédoublonnage de données.

Type de dédoublonnage de données Avantages Inconvénients
Post-traitement
Restriction: Vous pouvez utiliser le dédoublonnage de données post-traitement uniquement avec des pools de stockage à accès séquentiel (FILE).
  • Une fois le dédoublonnage de données terminé, vous pouvez récupérer le pool de stockage.
  • Temps de traitement plus longs en raison de la nécessité d'identifier les données avant de supprimer les données en double du pool de stockage.
En ligne
Restriction: Vous pouvez utiliser le dédoublonnage de données en ligne uniquement avec les pools de stockage de conteneur de répertoire et de conteneur cloud.
  • Supprime les données en double à mesure que les données sont écrites dans un pool de stockage de conteneur.
  • Réduit la nécessité de réorganisation hors ligne, améliorant ainsi les performances du serveur.
  • Réduit les coûts de matériel de stockage.
  • Utilisation du processeur plus élevée côté serveur.
Côté client
  • Le traitement est distribué entre le serveur et le client durant un processus de sauvegarde.
  • Utilisation du processeur plus élevée côté client.
  • Temps écoulé plus long pour les opérations client, telles que la sauvegarde.
  • Seules les données compressées et dédoublonnées sont envoyées au serveur.