Executando tarefas de fluxo de mascaramento
Em tarefas de fluxo de mascaramento, os usuários de dados definem o destino alvo para cópias de dados mascarados. As tarefas podem ser planejadas e, após a conclusão de um tarefa com êxito, é possível visualizar o resumo do relatório da tarefa.
Há duas maneiras de criar tarefas de fluxo de mascaramento:
- Após criar um fluxo de mascaramento, clique em Configurar tarefa.
- Clique no menu Opções em um ativo de dados individual para ignorar a criação de um fluxo de mascaramento e para configurar uma tarefa de mascaramento diretamente para esse ativo de dados.
Nota: durante uma tarefa de fluxo de mascaramento, podem ocorrer erros quando não houver memória suficiente para suportar a tarefa.. Para evitar erros, o tamanho máximo de dados não pode ser maior do que 12GBs.
Criação de ambiente de fluxo de mascaramento
Permissões necessárias
Para criar um modelo de ambiente, ambas as condições a seguir devem ser verdadeiras:
- Você deve ter a função de Administrador ou Editor no projeto.
- Você deve pertencer à conta IBM Cloud do criador do projeto.
Para criar um modelo de ambiente para seu projeto:
- Em seu projeto, clique na guia Manage (Gerenciar ) e, em seguida, na página Environments (Ambientes ).
- Na página Ambientes, clique na guia Modelos e, em seguida, clique em Novo modelo.
- Defina os detalhes do ambiente inserindo um nome e uma descrição (opcional).
- Em Type (Tipo ), clique em Spark.
- Em Configuração de hardware, especifique a configuração do driver e do executor com base no tamanho da tabela no trabalho de fluxo de mascaramento.
- Em Número de executores, aumente o número de executores para melhorar o desempenho do fluxo de mascaramento quando os trabalhos estiverem configurados para serem executados com partições. Para obter mais informações, consulte a seção Práticas recomendadas do tópico Gerenciamento do desempenho no trabalho.
- Na lista Versão do software, selecione Masking Flow Spark.
- Clique em Criar.
Trabalhando com Tarefas
Para configurar uma tarefa:
- Insira o nome da tarefa e inclua uma descrição opcional da tarefa.
- Inclua a conexão de destino em que deseja inserir cópia de dados mascarados. A conexão de origem é usada para ler dados.
- Clique em + para incluir uma nova conexão. O esquema mapeia a tabela de origem para a tabela de destino. As definições da tabela já devem ser configuradas no esquema de destino.
Dica: quando o ativo de origem for Apache Hive, use Apache HDFS como a conexão de destino.
- (Opcional) Na página Partition (Partição ), você pode editar opcionalmente os detalhes da partição do ativo:
- Se você criar fluxos de mascaramento com Definir amostragem, poderá ignorar com segurança a edição da página Partição, definindo a opção Editar detalhes da partição como Desativado.
- Se você tiver tabelas com grandes quantidades de dados, considere a possibilidade de editar os detalhes da partição especificando uma coluna como a coluna de partição. Para melhorar o desempenho do trabalho, você pode aumentar o número de partições. Para obter mais informações, consulte a seção Práticas recomendadas do tópico Gerenciamento do desempenho no trabalho.
- (Opcional) Planeje uma tarefa ou planeja uma tarefa recorrente.
- (Opcional) Na página Incremental job (Trabalho incremental ), é possível habilitar o trabalho para filtrar os registros da tabela de origem usando a coluna Date (Data ) e seguindo o formato de data AAAA-MM-DD especificando o valor de deslocamento Days (Dias). A opção de trabalho incremental estará disponível se a opção de partição estiver desativada.
Exemplo:
Se a opção de trabalho incremental estiver habilitada com o deslocamento de dias de 5 (N) e a coluna de data for especificada comoTRANSACTION_DATE, então quando o trabalho é executado em uma determinada data, por exemplo, 2025-07-31 (X), ele filtra os registros da tabela de origem onde oTRANSACTION_DATEé igual a XN, ou seja, 2025-07-26. Esses registros filtrados são então copiados para a tabela do banco de dados de destino. - Revise e execute a tarefa.