Em Data Virtualization, você pode virtualizar e usar dados armazenados como arquivos no armazenamento de objetos. Você pode virtualizar dados em arquivos nas seguintes fontes de dados de armazenamentos de objetos: Segmentar ou combinar dados de um ou mais arquivos para criar uma tabela virtual.
Sobre essa tarefa
Assista ao vídeo a seguir para obter uma visão geral dos arquivos virtualizados em " Cloud Object Storage na Data Virtualization.
Este vídeo oferece um método visual para aprender os conceitos e as tarefas desta documentação.
Procedimento
- No menu de navegação, clique em para exibir o menu de serviço.
- No menu de serviço, clique em e, em seguida, clique na guia Arquivos.
A lista de origens de dados disponíveis aparece. É possívelrestringir os ativos exibidos usando os filtros disponíveis.
Se você especificou um nome de bucket ao configurar a conexão da fonte de dados, clique
em para expandir os detalhes da conexão do armazenamento de objetos e ver o tipo de serviço e as informações do bucket. Se você não tiver especificado um nome de depósito ao configurar a conexão de origem de dados, será possível usar o campo de entrada Depósito para localizar um depósito específico no terminal.
Se a lista de fontes de dados não aparecer, clique em Atualizar
.
- Selecione o terminal do Object Storage no qual deseja procurar arquivos e caminhos de arquivo.
Para Cloud Object Storage, o terminal é a URL para o Object Storage.
Uma lista de caminhos de arquivo ou depósitos aparece no terminal. Você pode navegar pela estrutura do caminho do arquivo ou clicar em

para ver os detalhes do conteúdo do primeiro arquivo no caminho do arquivo.
Não é possível incluir o depósito no seu carrinho. Para incluir um caminho de arquivo no carrinho, deve-se selecionar o caminho de arquivo para visualizar os arquivos no caminho e, em seguida, clicar em Incluir no carrinho. Não é possível selecionar um arquivo no nível do depósito e deve-se incluir o arquivo em um caminho de arquivo no depósito.
- Selecione o caminho de arquivo ou arquivo que você deseja virtualizar e clique em Adicionar ao carrinho.
Importante:
- Não é possível virtualizar um único arquivo em um caminho de arquivo que contém vários arquivos. A URL é resolvida para o caminho pai no qual o arquivo está localizado e todo o caminho de arquivo é virtualizado. Se desejar virtualizar um único arquivo, será possível movê-lo para um caminho de arquivo separado.. O caminho de arquivo separado não deve ser um caminho de subarquivo de qualquer outro caminho de arquivo que seja ou será virtualizado.
- Os arquivos que você deseja virtualizar devem estar dentro de um caminho de arquivo, e não no mesmo nível do depósito. Por exemplo, não é possível virtualizar um arquivo s3a://mynewbigsqlbucket/mydata.csv; deve-se colocar mydata.csv em um caminho de arquivo e virtualizar s3a://mynewbigsqlbucket/fi1epath1/mydata.csv porque o processo de virtualização não pode criar uma tabela externa usando apenas um nome de depósito sem um caminho.
- Clique em Visualizar carrinho para previsualizar suas seleções de dados de arquivo como um arquivo virtual.
Nessa janela, é possível editar nomes de esquemas, visualizar arquivos que participam de uma tabela mesclada ou remover uma seleção do seu carrinho.
Se você tiver o site IBM® Knowledge Catalog instalado, poderá publicar sua tabela virtual em um catálogo. Para obter mais informações, consulte Publicando dados virtuais no catálogo em Data Virtualization.
- Recomendado: atualize o tipo de colunas particionadas de STRING para algo mais apropriado. Inspecione e especifique manualmente os tipos adequados para colunas de particionamento para melhor desempenho.
- Opcional: Clique em
e selecione Editar colunas.É possível editar qualquer nome de coluna que não esteja identificado como uma Coluna de Particionamento e alterar os tipos de coluna usando o menu suspenso Quando você estiver satisfeito com suas edições, clique em Aplicar. Os nomes de colunas atualizados são mostrados após a virtualização da tabela.Nota: quando você virtualiza arquivos JSON com dados em japonês no
IBM Cloud Object Storage e os nomes de colunas em japonês não são exibidos corretamente, é possível usar a opção
allownonalphanumeric para visualizar os cabeçalhos de colunas em japonês virtualizados corretamente... Essa opção é desativada por padrão e você deve ativá-la. Para obter mais informações, consulte
Os nomes das colunas em japonês não são exibidos corretamente nos dados virtualizados.
- Selecione as opções de compartilhamento apropriadas para a tabela virtualizada.
- Selecione Publicar no catálogo se você também quiser publicar em um catálogo selecionado.
Uma lista de catálogos disponíveis é mostrada no menu suspenso. Cada catálogo é identificado como
Controlado ou
Não controlado.
Observação: Você deve ter pelo menos um catálogo em
IBM Knowledge Catalog.
Deve-se ter permissão para publicar em um catálogo. Um administrador pode permitir se todos os objetos virtuais são publicados em um catálogo controlado selecionado, o que evita que um usuário publique em um catálogo especificado.
- Especifique um esquema no campo Esquema .
Também é possível criar um esquema seguindo estas etapas.
- Se você tiver a função Engenheiro Data Virtualization ou Usuário, deixe o campo Schema como padrão para criar um esquema com seu ID de usuário.
- Se você tiver a função Data Virtualization Manager, deixe o campo Schema como padrão para criar um esquema com seu ID de usuário ou digite o novo nome do esquema no campo Schema.
- Clique em Virtualizar para concluir o processo.
Quando a janela de status aparece, é possível selecionar para visualizar seus dados virtualizados ou virtualizarmais dados.
O que fazer a seguir
- Visualizar a estrutura de tabela e os metadados.
- Gerenciar o acesso à tabela.
- Edite os nomes de colunas e os tipos de ativos do Object Storage para que seja possível preparar dados precisos para virtualização.
- Colete estatísticas para a tabela virtualizada para otimizar o desempenho da consulta. Para obter mais informações, consulte Coletando estatísticas no Data Virtualization.
Opcionalmente, na página Dados virtualizados, publique seu objeto virtual no catálogo. Para obter mais informações, consulte Publicando dados virtuais no catálogo em Data Virtualization.