Mascaramento de dados virtuais na Data Virtualization

Use regras de proteção de dados para mascarar dados virtuais. Quando consultadas, as colunas mascaradas retornam dados disfarçados.

O mascaramento de dados se aplica somente aos conjuntos de resultados das consultas. Os dados originais em tabelas ecolunas permanecem intocados. O mascaramento não se aplica aos predicados ou visualizações de consultas. É possível usar o mascaramento de dados paraevitar a exposição de dados sensíveis. No entanto, o mascaramento de dados não impede que os usuários Data Virtualization de dados se conectem ao serviço e executem consultas com base nesses dados. Os usuários podem unir e agrupar dados, gerar os relatórios, executar análises e coletar insights usando os dados brutos, enquanto mascaram apenas o conjunto de resultados.

Para obter mais informações, consulte Mascaramento de dados com regras de proteção de dados na documentação do site IBM Knowledge Catalog .

As regras de mascaramento de dados se aplicam somente aos seguintes objetos na Data Virtualization:

  • Objetos virtualizados
  • Tabelas Db2 nativas
  • Tabelas de consulta materializada (MQTs)

Dependendo dométodo de mascaramento de dados, os dados são editados, substituídos ou ofuscados. Para obter mais informações, consulte Governando dados virtuais com regras de proteção de dados em Data Virtualization. Um ícone de cadeado (Ícone de bloqueio) ao lado do nome da coluna em seus dados virtualizados indica que os dados na coluna estão mascarados por uma regra de proteção de dados.

Assista ao vídeo a seguir para obter uma visão geral do mascaramento de dados em Data Virtualization.

Este vídeo oferece um método visual para aprender os conceitos e as tarefas desta documentação.

Ações de mascaramento suportadas

As seguintes ações de mascaramento são compatíveis com a Data Virtualization:
  • Edição de dados (básico)
    Mapeamento de dados de ação Editar
    A lista a seguir descreve quais tipos de dados são mapeados para a ação Redact na Data Virtualization.
    • O VARCHAR é mascarado para o comprimento de coluna 'XXXXXXXXXX' ou 'X' *, o que for mais curto.
    • O CHAR é mascarado para o comprimento de coluna 'XXXXXXXXXX' ou 'X' *, o que for mais curto.
    • Tipos de dados numéricos são mascarados para 0.
    • DATE é mascarado para '2001-01-01'.
    • TIME é mascarado para '00:00:00'.
    • TIMESTAMP é mascarado para DATE ('2001-01-01 00:00:00.0').
    • BOOLEAN é editado como "False".
  • Edição de dados parcial (Avançado)
    A opção para preservar o comprimento original do valor mascarado usa o comprimento do seguinte:
    • As colunas VARCHAR usam o comprimento do valor da célula sem máscara.
    • As colunas CHAR usam o comprimento da coluna.
  • substituição
    Mapeamento de dados de ação Substituir
    CHAR, VARCHAR
    A ação de mascaramento Substituto é baseada em um hash sha256 salgado e quando é usado com colunas CHAR/VARCHAR, ele obtém base64 codificado. O comprimento da coluna deve ter pelo menos 43 bytes para evitar colisões (duas entradas distintas resultando na mesma saída).
    SMALLINT, INT, BIGINT, DECIMAL, DUPLO, REAL, DECFLOAT
    A substituição exibe um hash numérico do valor original. Se o valor resultante tiver um "0" à esquerda, esse zero não será exibido. Por exemplo, um valor mascarado de "02" é exibido como apenas como "2".
    DATA, DATA E HORA
    Substituição exibe uma representação em hash do valor original.
    CLOB, BLOB, BINÁRIO, VARBINÁRIO

    NULL (ou valor vazio se a coluna for definida como NOT NULL)

    Outros dados
    Efetua fallback para a ação Editar.
  • Ofuscação (Básico)
  • Ofuscação (Avançado).
A seguinte ação de mascaramento não é suportada.
  • Opções de formatação de caracteres com o método Identificador
Para ofuscação avançada, a lista de subpropriedades a seguir é suportada
  • Preservar formato
  • Consistência repetida
  • Consistência aleatória
  • Validação de entrada
  • Método identificador
Para obter mais informações sobre ofuscação avançada, consulte Método de dados de ofuscamento (fluxo de Mascaramento).

Para opções de ofuscação e mascaramento avançado, as seguintes classes de dados são suportadas.

  • Nome de Pessoa
  • Nome
  • Sobrenome
  • Sufixo de nome
  • Título honorífico
  • Sexo
  • Endereço de e-mail
  • Data de nascimento
  • Carteira de motorista
  • Todos os 50 formatos de número de carta de condução do estado dos EUA
  • Número do Seguro Social nos EUA
  • Últimos quatro dígitos do Número de Seguridade Social dos EUA

  • Etnia
  • Cor dos olhos
  • Cor do cabelo
  • Atividade de hobby/lazer
  • Estado civil
  • Partido político
  • Status do emprego
  • Relacionamento
  • Religião
  • Código ou Nome do Idioma conforme ISO 369

  • Nome da organização
  • Identificador de Negócios Dun & Bradstreet
  • Número do DUNS
  • Empresa Fortune 1000
  • Termos comerciais internacionais
  • Código de entidade comercial e do governo

  • Linha de endereço
  • Linha de endereço 1
  • Linha de endereço 2
  • Linha de endereço 3
  • Nome do país
  • Códigos de país
  • Nome da rua dos EUA
  • Nome da capital do estado dos EUA
  • CEP dos EUA
  • Número do telefone dos EUA
  • Códigos de Estado dos EUA
  • Nomes do Estado dos EUA:
  • Nomes do condado dos EUA.
  • Nome do estado/município
  • Cidade (Inglês)
  • Códigos da província do Canadá:
  • Nomes da província do Canadá:
  • Latitude
  • Longitude
  • Código ISO 3166-2 do estado / província do país

  • Endereço de Protocolo da Internet
  • Endereço Internet Protocol Versão 6

  • Identificador Identificador Banco
  • Número da conta

  • Número do Cartão de Crédito
  • Cartão de Crédito Visa Card
  • Cartão de crédito American Express
  • Cartão de Crédito do Cartão Principal
  • Descobrir Cartão de Crédito
  • Cartão de Crédito Diners Club
  • Cartão de Crédito do Departamento de Crédito do Japão

  • Data
  • Data/hora
  • Mês
  • Temperatura

  • Número de Registro de Veículo Alemão

  • Classificação Estatística Internacional de Doenças v10

Observações de uso

  • O suporte ao mascaramento de dados em Data Virtualization é limitado aos seguintes tipos de dados:
    • Sequências de caracteres (CHAR, VARCHAR)
    • Numérico (SMALLINT, INT, BIGINT, DECIMAL, DOUBLE, REAL, DECFLOAT)
    • Data e hora (DATE, TIMESTAMP)
    • Booleano
  • As colunas do tipo de dados TIME são sempre mascarados como 00:00:00.000 , independentemente de como a regra de mascaramento é definida
  • Colunas de tipos CLOB, BLOB, BINARY e VARBINARY são mascaradas como NULL (ou como um valor vazio se a coluna for definida como NOT NULL) independentemente da ação de mascaramento.
  • O mascaramento não é aplicado a predicados de consulta como as cláusulas WHERE, GROUP BY, JOIN, HAS, SELECT DISTINCT e ORDER BY em uma instrução SQL.
  • Para que as regras de mascaramento de dados sejam aplicadas, os objetos virtuais devem ser capturados em um catálogo controlado e usar o tipo de conexão do Data Virtualization.
  • As regras de mascaramento de dados não podem ser aplicadas diretamente às visualizações Os conjuntos de resultados de visualizações são mascarados de acordo com as regras de proteção de dados que se aplicam aos objetos que são referenciados pela visualização. É possível mascarar detalhes de identificação de tabelas que são referenciadas na definição de visualização.
  • A edição de dados, incluindo parcial, de colunas de todos os tipos de dados numéricos resultará no mascaramento como 0..
  • Defina as regras de proteção de dados utilizando a interface com o usuário do construtor de regras Data Virtualization suporta as opções de redação parcial descritas em Governando dados virtuais com regras de proteção de dados em Data Virtualization.
  • Para assegurar os resultados corretos, use as designações de classes de dados apropriadas para as definições de coluna Por exemplo, não designe uma classe de dados de CEP a uma coluna do tipo DECIMAL
  • A ofuscação de classes de dados não suportadas sempre executará o mascaramento do Identificador, que mascara letras com letras e dígitos com dígitos e mantém maiúsculas e minúsculas.
  • Quando os valores NULL são substituídos ou ofuscados, um valor aleatório é fabricado (não determinístico) para as colunas com classes de dados suportadas. Os valores NULL em colunas com classes de dados não suportadas retornam à edição de dados padrão.
  • Quando o método de mascaramento Identificador é usado com ofuscação, valores vazios são editados.
  • Funções agregadas, como o SUM, podem causar overflow numérico no mascaramento de substituição. É possível converter a coluna em um tipo de grau mais alto, conforme mostrado no exemplo a seguir:
    SELECT SUM(CAST(VALUE AS DECIMAL(31,0))) FROM PROJECT1.CUSTOMERS
  • Ao usar a opção validação de entrada em regras de ofuscação , qualquer valor de entrada que não seja conhecido pelos dicionários internos será considerado inválido e redaction será executado no lugar.
  • A edição de dados produz o melhor desempenho possível. Substituição e ofuscação usam algoritmos mais avançados, resultando em maior sobrecarga.
  • As colunas mascaradas não podem ser usadas em SELECT (incluindo visualizações) derivadas de uma operação de conjunto que envolve um operador de conjunto EXCEPT, EXCEPT ALL, INTERSECT, INTERSECT ALL ou UNION.

Limitações

  • Importante:

    Quando você visualiza, faz download ou refina Data Virtualization ativos de dados em serviços Watson que não sejam Data Virtualization, em Cloud Pak for Data (por exemplo, IBM Knowledge Catalog, Watson Studio e Data Refinery) e nos casos em que se aplica o mascaramento de dados ou a filtragem em nível de linha, a visualização está sujeita apenas às regras de proteção de dados e ao controle de acesso ao catálogo ou ao projeto. Data Virtualization os controles de acesso não são aplicados.

    O controle de acesso à Data Virtualization não é aplicado quando o mascaramento de dados ou a filtragem em nível de linha se aplica à visualização em serviços ' Watson (que não sejam Data Virtualization). Os controles de acesso interno Data Virtualization, que são controlados pelo uso de Gerenciar acesso na interface do usuário Data Virtualization, não se aplicam à visualização dos outros serviços " Watson com mascaramento ou filtragem em nível de linha. Você deve definir suas regras para gerenciar o acesso aos catálogos, projetos, ativos de dados ou conexões para controle de acesso nos outros serviços do Watson .

  • O método de mascaramento do identificador não é suportado em caracteres multibyte. Em vez disso, os caracteres de vários bytes serão redigidos com `X`.
  • O mascaramento de classes de dados personalizadas não é suportado em Data Virtualization. O método de mascaramento do identificador é usado no lugar.
  • As opções de formatação de caracteres na ofuscação não são suportadas e o mascaramento do Identificador, que mascara letras com letras e dígitos com dígitos e mantém letras maiúsculas e minúsculas, é executado no lugar.