Carregando dados por meio de fragmentos de código gerados

É possível incluir o código gerado automaticamente para carregar dados de ativos de dados do projeto em uma célula do bloco de notas O tipo de ativo pode ser uma conexão de arquivo ou de banco de dados.

Ao clicar em uma célula de código vazia em seu bloco de notas, clicando no ícone Fragmentos de código (o ícone de fragmentos de Código) na barra de ferramentas do bloco de notas, selecionando Ler dados e um ativo do projeto, é possível:

  • Insira as credenciais de acesso à origem de dados. Esse recurso está disponível para todos os ativos de dados que são incluídos em um projeto. Com as credenciais, é possível gravar seu próprio código para acessar o ativo e carregar os dados em estruturas de dados de sua escolha

  • Gere código que é incluído na célula do bloco de notas. O código inserido serve como uma iniciação rápida para permitir que você comece facilmente a trabalhar com um conjunto de dados ou uma conexão. Para os sistemas de produção, é necessário revisar cuidadosamente o código inserido para determinar se seu próprio código deve ser escrito para atender melhor às suas necessidades.

    Ao executar a célula de código, os dados são acessados e carregados na estrutura de dados que você selecionou.

    Notas:

    1. A capacidade de fornecer código gerado será desativada para algumas conexões se:
      • As credenciais de conexão forem credenciais pessoais

      • As credenciais de conexões são armazenadas em áreas seguras

    2. Se o tipo de arquivo ou conexão com o banco de dados que você está usando não aparecer nas listas a seguir, é possível selecionar para criar um código genérico. Para o Python este é um objeto StreamingBody e para o R um objeto textConnection.

As tabelas a seguir mostram quais conexões de origem de dados (tipos de arquivos e conexões com o banco de dados) suportam a opção de gerar código. As opções para gerar código variam, dependendo da origem de dados, da linguagem de codificação do bloco de notas e do cálculo de tempo de execução do bloco de notas

Tipos de arquivos suportados

Tabela 1. Tipos de Arquivo Suportados
Origem de dados Linguagem de codificação do bloco de notas Tipo de mecanismo de cálculo Suporte disponível para carregar dados
arquivos CSV
Python Distribuição do Anaconda Python  Carregar dados no pandasDataFrame
Com Spark Carregar dados no pandasDataFrame e no sparkSessionDataFrame 
Com Hadoop Carregar dados no pandasDataFrame e no sparkSessionDataFrame 
R Distribuição do Anaconda R  Carregar dados no quadro de dados R
Com Spark Carregar dados no quadro de dados R e no sparkSessionDataFrame 
Com Hadoop Carregar dados no quadro de dados R e no sparkSessionDataFrame 
Script Python
Python Distribuição do Anaconda Python  Carregar dados em pandasStreamingBody
Com Spark Carregar dados em pandasStreamingBody
Com Hadoop Carregar dados em pandasStreamingBody
R Distribuição do Anaconda R  Carregar dados em rRawObject
Com Spark Carregar dados em rRawObject
Com Hadoop Carregar dados em rRawObject
Arquivos JSON
Python Distribuição do Anaconda Python  Carregar dados no pandasDataFrame
Com Spark Carregar dados no pandasDataFrame e no sparkSessionDataFrame 
Com Hadoop Carregar dados no pandasDataFrame e no sparkSessionDataFrame 
R Distribuição do Anaconda R  Carregar dados no quadro de dados R
Com Spark Carregar dados no quadro de dados do R, no rRawObject e no sparkSessionDataFrame
Com Hadoop Carregar dados no quadro de dados do R, no rRawObject e no sparkSessionDataFrame
Arquivos .xlsx e .xls
Python Distribuição do Anaconda Python  Carregar dados no pandasDataFrame
Com Spark Carregar dados no pandasDataFrame
Com Hadoop Carregar dados no pandasDataFrame
R Distribuição do Anaconda R  Carregar dados em rRawObject
Com Spark Nenhum suporte de carregamento de dados
Com Hadoop Nenhum suporte de carregamento de dados
Tipos de arquivo de fluxo de octeto
Python Distribuição do Anaconda Python  Carregar dados em pandasStreamingBody
Com Spark Carregar dados em pandasStreamingBody
R Distribuição do Anaconda R  Carregar dados em rRawObject
Com Spark Carregar dados no rDataObject
Tipo de arquivo PDF
Python Distribuição do Anaconda Python  Carregar dados em pandasStreamingBody
Com Spark Carregar dados em pandasStreamingBody
Com Hadoop Carregar dados em pandasStreamingBody
R Distribuição do Anaconda R  Carregar dados em rRawObject
Com Spark Carregar dados no rDataObject
Com Hadoop Carregar dados no rRawData
Tipo de arquivo ZIP
Python Distribuição do Anaconda Python  Carregar dados em pandasStreamingBody
Com Spark Carregar dados em pandasStreamingBody
R Distribuição do Anaconda R  Carregar dados em rRawObject
Com Spark Carregar dados no rDataObject
Arquivos de imagem JPEG, PNG
Python Distribuição do Anaconda Python  Carregar dados em pandasStreamingBody
Com Spark Carregar dados em pandasStreamingBody
Com Hadoop Carregar dados em pandasStreamingBody
R Distribuição do Anaconda R  Carregar dados em rRawObject
Com Spark Carregar dados no rDataObject
Com Hadoop Carregar dados no rDataObject
Arquivos Binários
Python Distribuição do Anaconda Python  Carregar dados em pandasStreamingBody
Com Spark Carregar dados em pandasStreamingBody
Hadoop Nenhum suporte de carregamento de dados
R Distribuição do Anaconda R  Carregar dados em rRawObject
Com Spark Carregar dados em rRawObject
Hadoop Carregar dados no rDataObject