Carregando dados por meio de fragmentos de código gerados
É possível incluir o código gerado automaticamente para carregar dados de ativos de dados do projeto em uma célula do bloco de notas O tipo de ativo pode ser uma conexão de arquivo ou de banco de dados.
Ao clicar em uma célula de código vazia em seu bloco de notas, clicando no ícone Fragmentos de código (
) na barra de ferramentas do bloco de notas, selecionando Ler dados e um ativo do projeto, é possível:
Insira as credenciais de acesso à origem de dados. Esse recurso está disponível para todos os ativos de dados que são incluídos em um projeto. Com as credenciais, é possível gravar seu próprio código para acessar o ativo e carregar os dados em estruturas de dados de sua escolha
Gere código que é incluído na célula do bloco de notas. O código inserido serve como uma iniciação rápida para permitir que você comece facilmente a trabalhar com um conjunto de dados ou uma conexão. Para os sistemas de produção, é necessário revisar cuidadosamente o código inserido para determinar se seu próprio código deve ser escrito para atender melhor às suas necessidades.
Ao executar a célula de código, os dados são acessados e carregados na estrutura de dados que você selecionou.
Notas:
- A capacidade de fornecer código gerado será desativada para algumas conexões se:
As credenciais de conexão forem credenciais pessoais
As credenciais de conexões são armazenadas em áreas seguras
- Se o tipo de arquivo ou conexão com o banco de dados que você está usando não aparecer nas listas a seguir, é possível selecionar para criar um código genérico. Para o Python este é um objeto StreamingBody e para o R um objeto textConnection.
- A capacidade de fornecer código gerado será desativada para algumas conexões se:
As tabelas a seguir mostram quais conexões de origem de dados (tipos de arquivos e conexões com o banco de dados) suportam a opção de gerar código. As opções para gerar código variam, dependendo da origem de dados, da linguagem de codificação do bloco de notas e do cálculo de tempo de execução do bloco de notas
Tipos de arquivos suportados
| Origem de dados | Linguagem de codificação do bloco de notas | Tipo de mecanismo de cálculo | Suporte disponível para carregar dados |
|---|---|---|---|
| arquivos CSV | |||
| Python | Distribuição do Anaconda Python | Carregar dados no pandasDataFrame | |
| Com Spark | Carregar dados no pandasDataFrame e no sparkSessionDataFrame | ||
| Com Hadoop | Carregar dados no pandasDataFrame e no sparkSessionDataFrame | ||
| R | Distribuição do Anaconda R | Carregar dados no quadro de dados R | |
| Com Spark | Carregar dados no quadro de dados R e no sparkSessionDataFrame | ||
| Com Hadoop | Carregar dados no quadro de dados R e no sparkSessionDataFrame | ||
| Script Python | |||
| Python | Distribuição do Anaconda Python | Carregar dados em pandasStreamingBody | |
| Com Spark | Carregar dados em pandasStreamingBody | ||
| Com Hadoop | Carregar dados em pandasStreamingBody | ||
| R | Distribuição do Anaconda R | Carregar dados em rRawObject | |
| Com Spark | Carregar dados em rRawObject | ||
| Com Hadoop | Carregar dados em rRawObject | ||
| Arquivos JSON | |||
| Python | Distribuição do Anaconda Python | Carregar dados no pandasDataFrame | |
| Com Spark | Carregar dados no pandasDataFrame e no sparkSessionDataFrame | ||
| Com Hadoop | Carregar dados no pandasDataFrame e no sparkSessionDataFrame | ||
| R | Distribuição do Anaconda R | Carregar dados no quadro de dados R | |
| Com Spark | Carregar dados no quadro de dados do R, no rRawObject e no sparkSessionDataFrame | ||
| Com Hadoop | Carregar dados no quadro de dados do R, no rRawObject e no sparkSessionDataFrame | ||
| Arquivos .xlsx e .xls | |||
| Python | Distribuição do Anaconda Python | Carregar dados no pandasDataFrame | |
| Com Spark | Carregar dados no pandasDataFrame | ||
| Com Hadoop | Carregar dados no pandasDataFrame | ||
| R | Distribuição do Anaconda R | Carregar dados em rRawObject | |
| Com Spark | Nenhum suporte de carregamento de dados | ||
| Com Hadoop | Nenhum suporte de carregamento de dados | ||
| Tipos de arquivo de fluxo de octeto | |||
| Python | Distribuição do Anaconda Python | Carregar dados em pandasStreamingBody | |
| Com Spark | Carregar dados em pandasStreamingBody | ||
| R | Distribuição do Anaconda R | Carregar dados em rRawObject | |
| Com Spark | Carregar dados no rDataObject | ||
| Tipo de arquivo PDF | |||
| Python | Distribuição do Anaconda Python | Carregar dados em pandasStreamingBody | |
| Com Spark | Carregar dados em pandasStreamingBody | ||
| Com Hadoop | Carregar dados em pandasStreamingBody | ||
| R | Distribuição do Anaconda R | Carregar dados em rRawObject | |
| Com Spark | Carregar dados no rDataObject | ||
| Com Hadoop | Carregar dados no rRawData | ||
| Tipo de arquivo ZIP | |||
| Python | Distribuição do Anaconda Python | Carregar dados em pandasStreamingBody | |
| Com Spark | Carregar dados em pandasStreamingBody | ||
| R | Distribuição do Anaconda R | Carregar dados em rRawObject | |
| Com Spark | Carregar dados no rDataObject | ||
| Arquivos de imagem JPEG, PNG | |||
| Python | Distribuição do Anaconda Python | Carregar dados em pandasStreamingBody | |
| Com Spark | Carregar dados em pandasStreamingBody | ||
| Com Hadoop | Carregar dados em pandasStreamingBody | ||
| R | Distribuição do Anaconda R | Carregar dados em rRawObject | |
| Com Spark | Carregar dados no rDataObject | ||
| Com Hadoop | Carregar dados no rDataObject | ||
| Arquivos Binários | |||
| Python | Distribuição do Anaconda Python | Carregar dados em pandasStreamingBody | |
| Com Spark | Carregar dados em pandasStreamingBody | ||
| Hadoop | Nenhum suporte de carregamento de dados | ||
| R | Distribuição do Anaconda R | Carregar dados em rRawObject | |
| Com Spark | Carregar dados em rRawObject | ||
| Hadoop | Carregar dados no rDataObject |