É possível combinar tabelas de várias origens de dados em uma única tabela virtual, que cria uma definição unificada contendo as colunas e os dados de todas as origens de dados participantes. Essas tabelas são referidas como tabelas agrupadas.
A segmentação é vertical (seja um subconjunto ou superconjunto de colunas com base em uma seleção de colunas escolhidas). É possível executar consultas na tabela virtual resultante da mesma forma que você consultaria qualquer uma das tabelas base.
As tabelas poderão ser agrupadas em uma única tabela virtualizada se os nomes de tabelas resolvidos pelo driver forem os mesmos (uma correspondência exata, com distinção entre maiúsculas e minúsculas). A semântica de agrupamento de tabelas considera as colunas com o mesmo nome (sem distinção entre maiúsculas e minúsculas) para correspondência. A promoção do tipo de dados segue regras de precedência.
Deve-se assegurar que o agrupamento de tabelas seja lógico, especialmente referente à manipulação de tipos de dados da tabela agrupada de resultados. Em alguns casos, as colunas correspondentes podem ter tipos de dados diferentes. As regras são usadas para determinar os tipos de dados de resultado da tabela agrupada. Para obter mais informações, consulte Regras para tipos de dados de resultados.
Para evitar resultados inesperados, deve-se ter cuidado ao agrupar tabelas em uma única tabela virtualizada. As recomendações a seguir podem ser consideradas ao criar uma tabela agrupada, embora nada seja restrito.
- Assegure-se de que as colunas com o mesmo nome de todas as tabelas tenham tipos de dados e uso de negócios compatíveis. O domínio de dados em todas as tabelas deve ser compatível.
- Agrupe tabelas do mesmo tipo de origem de dados para assegurar a semântica de dados consistentes.
- Ao agrupar tabelas de diferentes tipos de origens de dados, assegure a semântica de dados consistentes.
- Assegure-se de que todas as tabelas no grupo tenham mais colunas com os mesmos nomes. Assegure-se de que colunas correspondentes tenham tipos de dados compatíveis.
- Não inclua colunas que estejam definidas em tipos complexos.
Nota: Algumas origens de dados, como Hive, usam o padrão em minúsculas para nomes de tabelas. Essas tabelas não podem ser agrupadas com tabelas de outras origens de dados que tenham maiúsculas como padrão, a menos que identificadores delimitados sejam usados para assegurar uma correspondência exata em nomes de tabelas.
Sobre essa tarefa
Estas etapas descrevem como virtualizar dados sem termos de negócios. Se você quiser controlar seus dados virtuais, consulte Controle de dados virtuais na Data Virtualization.
Procedimento
- No menu de navegação, clique em para exibir o menu de serviço.
- No menu de serviço, clique em e clique na guia Tabelas.
A lista de conexões aparece na visualização Explorar padrão.. Clique em uma conexão, esquema ou tabela para selecioná-la e visualizar o conteúdo.
A lista de tabelas disponíveis em suas conexões aparece na visualização Lista.. É possível filtrar as tabelas listadas, incluindo filtros na página Origens de Dados Além disso, é possível procurar tabelas por nome, esquema, coluna ou termo de negócios..
Data Virtualization pode sugerir automaticamente tabelas correspondentes que podem ser combinadas em uma única tabela virtual.
- Para combinar tabelas em um único objeto virtual, clique em Configurações
e selecione Agrupar tabelas com nomes idênticos no menu de configurações.
A exibição mostra o agrupamento sugerido de tabelas e é possível ajustar com precisão as tabelas de origem participantes na etapa Revisão.
A lista de tabelas disponíveis inclui tabelas nas quais a permissão de leitura não é concedida (tabelas não legíveis).
- Se você criar uma tabela virtual que inclua uma tabela não legível, selecione uma das opções a seguir para tornar a tabela virtual consultável.
- Opção 1 Clique em Editar tabelas agrupadas no menu de ação da tabela e remova a tabela não legível do grupo que está sendo virtualizado.
- Opção 2 Assegure-se de que o usuário designado à conexão de origem de dados possa acessar a tabela não legível. Esta etapa pode acontecer antes ou após a virtualização da tabela.
- Opção 3 Crie uma conexão de fonte de dados na Data Virtualization para acessar a mesma fonte de dados com credenciais para um usuário separado que tenha acesso de leitura à tabela. Como resultado, a lista de instâncias de tabela adicionais aparece ao selecionar a opção Agrupar tabelas com nomes idênticos. Antes de virtualizar tabelas, deve-se ainda remover manualmente as tabelas não legíveis descobertas sob a conexão do usuário restrito (conforme descrito na opção 1).
- Selecione a tabela que você deseja virtualizar e clique em Adicionar ao carrinho.
- Clique em Visualizar carrinho para visualizar suas seleções. A partir desta janela, você também pode editar os nomes da tabela e do esquema ou remover uma seleção do seu carrinho.
- Selecione as opções de compartilhamento apropriadas para a tabela virtualizada.
- Selecione Publicar no catálogo se você também quiser publicar em um catálogo selecionado.
Uma lista de catálogos disponíveis é mostrada no menu suspenso. Cada catálogo é identificado como
Controlado ou
Não controlado.
Observação: Você deve ter pelo menos um catálogo em
IBM® Knowledge Catalog.
Deve-se ter permissão para publicar em um catálogo. Um administrador pode permitir se todos os objetos virtuais são publicados em um catálogo controlado selecionado, o que evita que um usuário publique em um catálogo especificado.
- Especifique um esquema no campo Esquema .
Também é possível criar um esquema seguindo estas etapas.
- Se você tiver a função Engenheiro Data Virtualization ou Usuário, deixe o campo Schema como padrão para criar um esquema com seu ID de usuário.
- Se você tiver a função Data Virtualization Manager, deixe o campo Schema como padrão para criar um esquema com seu ID de usuário ou digite o novo nome do esquema no campo Schema.
- Clique em Virtualizar para concluir o processo.
Quando a janela de status aparece, é possível selecionar para visualizar seus dados virtualizados ou virtualizarmais dados.
- Clique em Visualizar dados virtualizados para ver suas tabelas recém-criadas.