Tutorial de integração de dados: Virtualize dados externos
Pegue este tutorial para virtualizar dados armazenados em três fontes de dados externas com o caso de uso de integração de dados do julgamento de malha de dados. Seu objetivo é usar Data Virtualization para criar tabelas virtuais e unir as tabelas virtuais a partir dos dados existentes que se encontram em três fontes de dados: um Db2 Warehouse, um banco de dados PostgreSQL e um banco de dados MongoDB. Se você concluiu o tutorial Integrar dados, realizou muitas das mesmas tarefas usando o DataStage que este tutorial realiza usando a Data Virtualization.
A história para o tutorial é que o Golden Bank precisa aderir a um novo regulamento em que não pode emprestar a candidatos a empréstimos sub-qualificados. Você usará Data Virtualization para combinar dados de diferentes fontes de dados sem movimentação de dados e disponibilizar os dados virtuais para outros cientistas de dados e engenheiros de dados em um projeto.
A imagem animada a seguir fornece uma prévia rápida do que você vai realizar até o final deste tutorial. Você se conectará a fontes de dados externas, criará tabelas virtuais e visualizações e as adicionará a um projeto. Clique na imagem para visualizar uma imagem maior.
Visualizando o tutorial
Neste tutorial, você concluirá estas tarefas:
- Configure os pré-requisitos
- Tarefa 1: verifique o Platform assets catalog.
- Tarefa 2: incluir conexões de dados no Platform assets catalog.
- Tarefa 3: adicionar fontes de dados à Data Virtualization.
- Tarefa 4: Virtualizar tabelas de dados.
- Tarefa 5: Criar visualizações de junção virtual unindo tabelas virtuais.
- Tarefa 6: gerar uma chave de API.
- Tarefa 7: acesse a visualização de junção virtual no projeto.
- Cleanup (Opcional)
Assista a este vídeo para visualizar as etapas deste tutorial. Pode haver ligeiras diferenças na interface do usuário mostrada no vídeo. O vídeo tem como objetivo ser um acompanhante para o tutorial escrito.
Este vídeo fornece um método visual para aprender os conceitos e tarefas nesta documentação.
Dicas para concluir este tutorial
Aqui estão algumas dicas para concluir com sucesso este tutorial.
Use a imagem em vídeo
A imagem animada a seguir mostra como usar os recursos de imagem em vídeo e de índice:

Configure as janelas do navegador
Para uma experiência ideal ao concluir este tutorial, abra sua conta em uma janela do navegador e mantenha esta página do tutorial aberta em outra janela do navegador para alternar facilmente entre as duas janelas. Considere organizar as duas janelas do navegador lado a lado para facilitar o acompanhamento.

Configure os pré-requisitos
Inscreva-se para o Cloud Pak for Data as a Service
Deve-se se inscrever para o Cloud Pak for Data as a Service e provisionar os serviços necessários para o caso de uso de integração de Dados
- Se você tiver uma conta existente do Cloud Pak for Data as a Service , será possível iniciar este tutorial. Se você tiver uma conta do plano Lite, apenas um usuário por conta poderá executar este tutorial
- Se você ainda não tiver uma conta, inscreva-se para uma avaliação de tecido de dados.
Assista ao vídeo a seguir para saber mais sobre a malha de dados no Cloud Pak for Data.
Este vídeo fornece um método visual para aprender os conceitos e tarefas nesta documentação.
Verifique os serviços fornecidos necessários
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 01:06.
Siga estas etapas para verificar ou fornecer os serviços necessários:
No menu Navegação
, selecione Serviços > Instâncias de serviço.
Use a lista suspensa Product (Produto ) para determinar se existe uma instância de serviço do Data Virtualization.
Se você precisar criar uma instância de serviço de Data Virtualization, clique em Adicionar serviço.
Selecione Data Virtualization.
Selecione o plano Lite ..
Clique em Criar.
Aguarde enquanto o serviço Data Virtualization é provisionado, o que pode levar alguns minutos para ser concluído.
Repita essas etapas para verificar ou provisionar os serviços adicionais a seguir:
- IBM watsonx.data intelligence
- Cloud Object Storage
Verifique seu progresso
A imagem a seguir mostra as instâncias de serviço fornecidas:

Criar o projeto de amostra
Para visualizar esta tarefa, assista ao vídeo a partir de 01:46.
Se você já tiver o projeto de amostra para este tutorial, vá para Tarefa 1. Caso contrário, siga estas etapas:
Acesse o projeto de amostra de integração de dados no hub de recursos.
Clique em Criar projeto.
Se solicitado a associar o projeto a uma instância Cloud Object Storage, selecione uma instância Cloud Object Storage a partir da lista.
Clique em Criar.
Aguarde a importação do projeto ser concluída e, em seguida, clique em Visualizar novo projeto para verificar se o projeto e os ativos foram criados com êxito.
Clique na guia Ativos para ver as conexões e o fluxo do DataStage
Verifique seu progresso
A imagem a seguir mostra a guia Ativos no projeto de amostra Agora você está pronto para iniciar o tutorial.

Tarefa 1: Verifique o catálogo de ativos da Platform assets catalog
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 02:42.
Você pode adicionar conexões em fontes de dados externas no nível da plataforma ou no nível de serviço. Quando você adiciona as conexões no nível da plataforma usando o Platform assets catalog, pode incluir facilmente essas conexões em projetos, catálogos e fontes de dados Data Virtualization. Siga estas etapas para verificar o Platform assets catalog
No menu Navegação
, selecione Dados > Conexões da plataforma.
Se você vir conexões existentes, já terá um Platform assets cataloge poderá ir para Tarefa 2. Se você não vir nenhuma conexão, mas vir uma opção para criar uma nova conexão, pule para a Tarefa 2.

Se você não tiver um Platform assets catalog, clique em Criar catálogo.

Selecione um Cloud Object Storage na lista.
Aceite o valor padrão para Manipulação de ativo duplicado.
Clique em Criar. A página Conexões da Plataforma é exibida
Verifique seu progresso
A imagem a seguir mostra as conexões da plataforma: A partir daqui, é possível criar conexões Como o projeto de amostra inclui as conexões, é possível incluir as conexões para as origens de dados externas neste catálogo a partir do projeto de amostra.

Tarefa 2: Adiciar conexões de dados com o catálogo de ativos da Platform assets catalog
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 03:22.
O projeto de amostra de integração de dados inclui várias conexões com origens de dados externas Em seguida, você adiciona três conexões ao Platform assets catalog e pode disponibilizar essas conexões na Data Virtualization. Siga estas etapas para publicar as conexões do projeto da amostra no Platform assets catalog.
No menu Navegação
, selecione Projetos > Exibir todos os projetos.
Clique no projeto Integração de dados .
Clique na guia Ativos.
Em Tipos de ativo, selecione Acesso a dados> Conexões.
Selecione os seguintes ativos de conexão:
- Data Fabric de avaliação- Db2 Warehouse
- Data Fabric Avaliação- MongoDB
- Data Fabric Avaliação- Databases for PostgreSQL
Clique em Publicar no Catálogo
Selecione o Catálogo de ativos de plataforma na lista e clique em Avançar.
Revise os ativos e clique em Publicar.
No menu Navegação
, selecione Dados > Conexões de plataforma para ver as três conexões publicadas no catálogo.
Verifique seu progresso
A imagem a seguir mostra as três conexões da Plataforma. Agora você está pronto para incluir origens de dados.

Tarefa 3: Adicionar fontes de dados à Data Virtualization
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 04:05.
Agora você pode adicionar essas fontes de dados externas do Platform assets catalog à Data Virtualization. Siga estas etapas para incluir as origens de dados:.
No menu Navegação
, selecione Dados > Data virtualization.
Nota: se você vir uma notificação para Configurar um catálogo primário para aplicar o controle, será possível fechar com segurança essa notificação. A configuração de um catálogo primário é opcional.Na página Fontes de dados, na exibição Tabela, clique em Adicionar conexão > Conexão de plataforma existente.

Selecione Data Fabric Trial- Db2 Warehouse.
Clique em Incluir.
Repita essas etapas para incluir as conexões Data Fabric Trial-Mongo DB e Data Fabric Trial- Databases for PostgreSQL .
Verifique seu progresso
A imagem a seguir mostra as origens de dados Agora você está pronto para criar uma tabela virtual a partir de dados armazenados nessas origens de dados externas.

Tarefa 4: Virtualizar tabelas de dados
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 04:40.
Você deseja virtualizar as tabelas MORTGAGE_APPLICATION, MORTGAGE_RECORRENTEe CREDIT_SCORES Mais tarde, você pode se juntar às duas primeiras tabelas virtuais com a terceira tabela para criar uma nova visão de junção virtual. Siga estas etapas para virtualizar as tabelas de dados:
No menu de serviço, clique em Virtualização > Virtualizar.

Se necessário, altere a visualização Tabelas e aguarde enquanto as tabelas são carregadas, o que pode levar até 30 segundos. Pode ser necessário clicar em Atualizar , para ver a lista completa de tabelas Ao ver Tabelas disponíveis, todas as tabelas serão carregadas. O número de mesas pode variar.

Na guia Tabelas , filtre as tabelas com base nos seguintes critérios:
Conector: IBM Db2 Warehouse e PostgreSQL
Banco de dados: Data Fabric Avaliação- Db2 Warehouse e Data Fabric Avaliação- Databases for PostgreSQL
Esquema: BANKING
Selecione as tabelas MORTGAGE_APPLICATION, MORTGAGE_RECORRENTEe CREDIT_SCORE para virtualizar.. É possível passar o mouse sobre um nome de tabela para ver o nome completo para verificar se você está selecionando os nomes de tabelas corretos
Clique em Incluir no Carrinho de Compras.
Clique em Visualizar carrinho para visualizar sua seleção. A partir daqui, é possível editar os nomes da tabela e do esquema, ou remover uma seleção do seu carrinho.
Por enquanto, desmarque a caixa de seleção ao lado de Designar ao projeto Esta ação disponibilizará as tabelas virtuais na página Dados virtualizados
Clique em Virtualizar.
Clique em Confirmar para iniciar a virtualização das tabelas
Quando a virtualização estiver concluída, clique em Acessar Dados Virtualizados para ver sua tabela recém-criada
Verifique seu progresso
A imagem a seguir mostra a página Dados virtualizados .. Agora você está pronto para criar uma tabela virtual juntando essas tabelas virtuais.

Tarefa 5: Criar visualizações de junção virtual associando tabelas virtuais
Você deseja criar uma visualização de junção virtual juntando as tabelas virtuais MORTGAGE_RECORRENTE e MORTGAGE_APPLICATION Em seguida, você deseja associar o objeto virtual resultante com a tabela virtual CREDIT_SCORE para criar uma segunda visualização de junção virtual
Visualização de junção virtual 1: Junte-se às tabelas virtuais MORTGAGE_RECORRENTE e MORTGAGE_APPLICATION
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 05:59.
Siga estas etapas para criar a primeira visualização de junção virtual::
Na página Dados virtualizados , selecione as tabelas MORTGAGE_APPLICATION e MORTGAGE_RECORRENTE para virtualizar..
Anote o nome do esquema. Você precisará desse nome posteriormente para executar uma consulta SQL.
Clique em Associar
Na lista de colunas da tabela MORTGAGE_APPLICATION, arraste para conectar a coluna ID com a coluna ID na tabela MORTGAGE_APPLICANT.

Selecione todas as colunas em ambas as tabelas
Clique em Visualizar para ver uma visualização das tabelas unidas
Fechar a janela de pré-visualização.
Clique em Abrir no editor de SQLe, em seguida, clique em Continuar no aviso de que não é possível retornar à tela de junção. O Editor SQL permite que você execute consultas no conjunto de dados. Nesse caso, você deseja visualizar quais registros o conjunto de dados conterá ao filtrar os candidatos da Califórnia.

Copie seu esquema e, em seguida, exclua a consulta existente. Você precisará inserir seu esquema na próxima instrução SQL.
Copie e cole a instrução SELECT a seguir para a nova consulta. Substitua
<your schema>pelo nome do esquema que você observou anteriormente.SELECT * FROM <your-schema>.MORTGAGE_APPLICANT WHERE STATE_CODE LIKE 'CA'Sua consulta parece semelhante a SELECT * FROM DV_IBMID_663002GN1Q.MORTGAGE_APPLICANT WHERE STATE_CODE LIKE 'CA'

Clique em Executar todos
Depois que a consulta for concluída, selecione a consulta na guia Histórico Na guia Resultados , é possível ver que a tabela é filtrada para apenas os candidatos do estado da Califórnia
Clique em Voltar para fechar o editor de SQL.
Agora que você visualiza o conjunto de dados filtrado em requerentes da Califórnia, você adicionará este critério de filtro à visão de junção virtual. Para a tabela MORTGAGE_RECORRENTE , copie a instrução a seguir para os critérios de filtro. Substitua
<your schema>pelo nome do esquema que você observou anteriormente."<your-schema>"."MORTGAGE_APPLICANT"."STATE_CODE"='CA'Seus critérios de filtro são semelhantes a "DV_IBMID_663002GN1Q". "MORTGAGE_APPLICANT". "STATE_CODE"='CA'

Clique em Avançar.
Você pode editar os nomes da coluna para diferenciar entre colunas com o mesmo nome em ambas as tabelas. Nesse caso, mantenha os nomes de colunas padrão, e clique em Avançar
Na página Designar e revisar , para Nome da visualização, digite
APPLICANTS_APPLICATIONS_JOINED.Por enquanto, desmarque a opção Designar para o projeto Posteriormente, você cria um objeto virtual e atribui isso ao projeto de integração de dados.
Clique em Criar visualização.
Quando a virtualização for concluída, clique em Acessar dados virtualizados para ver sua visualização de junção recém-criada..
Verifique seu progresso
A imagem a seguir mostra a página Dados virtualizados .. Agora você está pronto para criar uma segunda visualização de junção virtual.

Visualização de junção virtual 2: associar as tabelas virtuais APPLICANTS_APPLICATIONS_JOIN e CREDIT_SCORE
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 07:47.
Siga estas etapas para criar a segunda visualização de junção virtual:
Na página Dados virtualizados , selecione as tabelas APPLICANTS_APPLICATIONS_JUNTADAS e CREDIT_SCORE para virtualizar
Clique em Associar
Na lista de colunas para a tabela APPLICANTS_APPLICATIONS_UNIDA , arraste para conectar a coluna EMAIL_ADDRESS com a coluna EMAIL_ADDRESS na tabela CREDIT_SCORE
Clique em Visualizar para ver uma visualização das tabelas unidas
Fechar a janela de pré-visualização.
Clique em Avançar.
Aceite os nomes de colunas padrão, e clique em Avançar
Na página Designar e revisar , para Nome da visualização, digite
APPLICANTS_APPLICATIONS_CREDIT_SCORE_JOINED.Desta vez, mantenha Designar ao projeto selecionado e, em seguida, escolha o projeto de Integração de Dados
Clique em Criar visualização.
Quando a virtualização for concluída, clique em Acessar dados virtualizados para ver sua visualização de junção recém-criada..
Verifique seu progresso
A imagem a seguir mostra a página Dados virtualizados .. Agora você está pronto para trabalhar com dados virtuais em seu projeto.

Tarefa 6: Gerar uma chave API
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 08:27.
Você precisa fornecer suas credenciais pessoais na forma de uma chave API para visualizar ativos virtualizados. Se você ainda não tem uma chave de API salva, então siga estas etapas para criar uma chave de API.
Acesse a página de chaves de API no console do IBM Cloud. Faça login se solicitado.
Na página Chaves API , clique em Criar uma chave API do IBM Cloud. Se você tiver alguma chave API existente, o botão poderá ser rotulado Criar.
Digite um nome e uma descrição.
Clique em Criar.
Copiar a chave de API.
Faça o download da chave de API para uso futuro.
Verifique seu progresso
A imagem a seguir mostra a página de chaves de API. Agora você está pronto para visualizar a tabela virtual no projeto.

Tarefa 7: Acesse a visão de junção virtual no projeto
Para visualizar esta tarefa, assista ao vídeo a partir do minuto 09:01.
A tabela virtual foi adicionada ao seu projeto junto com uma conexão com a Data Virtualization. Siga estas etapas para abrir o projeto para ver os dados virtuais e as informações de conexão que são necessárias para acessar os dados virtuais.
Volte para o Cloud Pak for Data. No Menu de
Navegação, selecione Projetos > Exibir todos os projetos.
Abra o projeto de Integração de Dados
Clique na guia Ativos.
Abra qualquer um dos dados virtualizados. Por exemplo, clique no ativo de dados que começa com o nome do esquema seguido por APPLICANTS_APPLICATIONS_CREDIT_SCORE_ATRÁS para visualizá-lo (a)
Forneça suas credenciais para acessar o ativo de dados.
Para o Método de autenticação, selecione Chave API.
Cole sua chave API.

Clique em Conectar.
Percorra o ativo de dados para ver todos os candidatos do estado da Califórnia.
Verifique seu progresso
A imagem a seguir mostra os dados virtuais no projeto Agora você está pronto para analisar os dados virtuais.

Como engenheiro de dados do Golden Bank, você usou Data Virtualization para combinar dados de diferentes fontes de dados e com diferentes tipos. Você usou a sintaxe SQL e acessou e combinou dados sem movimento de dados.
Limpeza (Opcional)
Se você gostaria de reaproveitar os tutoriais no caso de uso de integração de dados, exclua os seguintes artefatos.
| Artefato | Como excluir |
|---|---|
| Conexões no catálogo de ativos da Platform assets catalog | Remover um ativo de um catálogo |
| Dados virtualizados | Navegue até Dados > Data virtualization; Na página Dados virtualizados, acesse o menu Excesso |
| Origens de dados | Navegue até Dados > Data virtualization; Na página Fontes de dados, clique no ícone Excluir |
| Projeto amostra de integração de dados | Excluir um Projeto |