Estágios do DataStage

Um fluxo do DataStage® consiste em estágios que são vinculados juntos, que descrevem o fluxo de dados de uma origem de dados para um destino de dados Um estágio descreve uma origem de dados, uma etapa de processamento ou um sistema de destino. O estágio também define a lógica de processamento que move os dados dos links de entrada para os links de saída.

Funções de estágio

Um estágio geralmente tem pelo menos uma entrada de dados ou uma saída de dados. No entanto, alguns estágios podem aceitar mais de uma entrada de dados, e produzir saída para mais de um estágio. A tabela a seguir lista os estágios disponíveis e dá detalhes sobre suas funções:

Tabela 1. Estágios
Estágio Ícone Função
Aggregator Ícone do agregador Classifica os dados recebidos em grupos, calcula os totais e outras funções de sumarização para cada grupo, e os passa para outro estágio na tarefa.
Bloom Filter Ícone Filtro de Bloom Consulta as chaves recebidas com relação a valores anteriores.
Change Apply Alterar ícone Aplicar Aplica operações de mudança codificadas em um conjunto de dados before baseado em um conjunto de dados changed. Os conjuntos de dados before e after vêm do estágio Change Capture.
Change Capture Ícone Alterar Captura Compara dois conjuntos de dados e faz um registro das diferenças.
Checksum Ícone de soma de verificação Gera um valor de soma de verificação por meio das colunas especificadas em uma linha e inclui a soma de verificação na linha.
Column Export Ícone de soma de verificação Exporta dados de um número de colunas de diferentes tipos de dados para uma única coluna de tipos de dados ustring, stringou binary.
Column Generator Ícone Gerador de Coluna Inclui colunas nos dados recebidos e gera dados simulados para essas colunas para cada linha de dados processada.
Column Import Ícone de Importação da Importa dados de uma única coluna e a emite como saída para uma ou mais colunas.
Combine Records Combinar ícone de Registros Combina registros em que os valores particulares de chave/coluna são idênticos em vetores de sub-registros.
Compare Ícone de comparação Executa uma comparação de registros coluna por coluna em dois conjuntos de dados de entrada classificados previamente.
Compress Ícone de compacta Utiliza o utilitário UNIX compress ou GZIP para comprimir um conjunto de dados. Ele converte um conjunto de dados de uma sequência de registros em um fluxo de dados binários brutos.
Copy Ícone Copiar Copia um único conjunto de dados de entrada em vários conjuntos de dados de saída.
Decode Ícone de decodificação Decodifica um conjunto de dados usando um comando de decodificação UNIX que você fornece.
Difference Ícone de diferença Executa uma comparação de registro por registro de dois conjuntos de dados de entrada, que são versões diferentes do mesmo conjunto de dados.
Distributed Transaction Ícone de Transação Distribuída Executa transações através de várias origens de dados
Encode Ícone de encode Codificar um conjunto de dados usando um comando de codificação UNIX que você fornece.
Expand Ícone de expansão Utiliza o utilitário uncompress ou GZIP do UNIX para expandir um conjunto de dados. Ele converte um conjunto de dados compactado anteriormente de volta em uma sequência de registros de um fluxo de dados binários brutos.
External Filter Ícone do Filtro externo Permite especificar um comando do UNIX que atua como filtro nos dados que estão sendo processados.
Filter Ícone de filtro Transfere, não modificados, os registros do conjunto de dados de entrada que atendem aos requisitos especificados e filtra todos os outros registros.
Funnel Ícone do funil Copia vários conjuntos de dados de entrada em um único conjunto de dados de saída.
Generic Ícone genérico Incorpora um Operador Orquestrate ® em seu trabalho.
Head Ícone da cabeça Seleciona os primeiros N registros de cada partição de um conjunto de dados de entrada e copia os registros selecionados em um conjunto de dados de saída.
Join Ícone de junção Realiza operações de junção na entrada de dois ou mais conjuntos de dados para o estágio e, em seguida, produz o conjunto de dados resultante.
Lookup Ícone de consulta Utilizado para executar operações de consulta em um conjunto de dados lido na memória por meio de qualquer outro estágio Parallel Job que possa produzir dados ou fornecido por um dos estágios do banco de dados que suportam links de saída de referência. Ele também pode realizar uma consulta em uma tabela de consulta que está contida em um estágio Lookup File Set.
Make Subrecords ícone Combina vectores especificados em um conjunto de dados de entrada em um vetor de sub-registros cujas colunas possuem os nomes e tipos de dados dos vetores originais.
Make Vector Fazer ícone Vector Combina colunas especificadas de um registro de dados de entrada em um vetor de colunas.
Merge Ícone de Mes Combina um conjunto de dados principal classificado com um ou mais conjuntos de dados de atualização classificados.
Modify Ícone de modificação Altera o esquema de registro de seu conjunto de dados de entrada.
Peek Ícone de Peek Imprime valores da coluna de registro no log da tarefa ou em um link de saída separado, à medida que o estágio copia registros de seu conjunto de dados de entrada para um ou mais conjuntos de dados de saída.
Pivot Enterprise Ícone do Pivot Enterprise

O estágio Pivot Enterprise é um estágio de processamento que transforma dados horizontal e verticalmente.

A tabela dinâmica horizontal mapeia um conjunto de colunas em uma linha de entrada para uma única coluna em várias linhas de saída.

A tabela dinâmica vertical mapeia um conjunto de linhas nos dados de entrada para colunas de saída simples ou múltiplas.

Promote Subrecords Ícone ícone de Subregistros Promove as colunas de um sub-registro de entrada para colunas de nível superior.
Remove Duplicates Remover Ícone Duplicatas Considera um único conjunto de dados classificado como entrada, remove todos os registros duplicados e grava os resultados em um conjunto de dados de saída.
Row Generator Ícone Gerador de Linha Produz um conjunto de dados simulados que se ajusta aos metadados especificados.
Sample Ícone de amostra Faz a amostragem de um conjunto de dados de entrada.
Slowly Changing Dimension (SCD) Ícone de classificação Funciona dentro do contexto de um banco de dados de esquemas de estrelas para armazenar e gerenciar dados atuais e históricos ao longo do tempo.
Sort Ícone de classificação Classifica colunas de entrada.
Split Subrecord Dividir ícone Subregistro Separa um campo de sub-registro de entrada em um conjunto de colunas de vetores de nível superior.
Split Vector Dividir ícone Vector Promove os elementos de um vetor de comprimento fixo para um conjunto de colunas de nível superior com nomes similares.
Stored Procedure Ícone de procedimento armazenado Executa procedimentos armazenados para seus fluxos.
Surrogate Key Generator stage Ícone Gerador de Chave Substituta Gera colunas de chave substitutas e mantém a origem da chave.
Switch Ícone do Comutador Adota um único conjunto de dados como entrada e designa cada registro de entrada para um conjunto de dados de saída com base no valor de um campo de seletor.
Tail Ícone do rabo Seleciona os últimos N registros de cada partição de um conjunto de dados de entrada e copia os registros selecionados para um conjunto de dados de saída.
Transformer Ícone do transformador Manipula dados extraídos, realiza quaisquer conversões que são necessárias, e transmite dados para outro estágio ativo ou um estágio que grava dados em um banco de dados ou arquivo de destino.
Wave Generator Ícone Gerador de Ondas Monitora um fluxo de dados e insere marcadores de end-of-wave onde necessário.
Web Service Ícone do Web Service Acessa operações de serviço da web em um fluxo ou tarefa do DataStage .
Write Range Map Ícone Mapa de Faixa de Gravação Grava dados em um mapa de alcance. O estágio pode possuir um único link de entrada.

Assista a esta série de vídeos para ver como usar os estágios mais comuns.