Nós suportando o SQL pushback

As tabelas a seguir mostram nós que representam operações de mineração de dados que suportam pushback de SQL. Se um nó não aparecer nessas tabelas, ele não suporta o SQL pushback.

Tabela 1. Nós de Operações de registro
Nós que suportam a geração de SQL Notas
Agregado O suporte a geração de SQL para agregação depende do tipo de armazenamento de dados.
Anexo Suporta geração se as entradas não estiverem ordenadas.

A otimização de SQL é possível apenas quando suas entradas possuírem o mesmo número de colunas.

Distinguir Um nó distinto com o modo (padrão) Criar um registro composto para cada grupo selecionado não suporta a otimização de SQL.
Mesclar Nenhuma SQL gerada para mesclar por ordem.

A mesclagem por chave com junção externa total ou parcial será suportada apenas se o banco de dados/driver suportar. Os campos de entrada não correspondentes podem ser renomeados por meio de um nó de filtro ou das configurações de filtro de um nó de importação.

Suporta a geração de SQL para mesclar por condição.

Para todos os tipos de mesclagem, SQL_SP_EXISTS não será suportado se as entradas originarem de bancos de dados diferentes.

Agregado RFM Suporta a geração de SQL, exceto se salvar a data da segunda ou da terceira transação mais recente ou se incluir somente transações recentes. No entanto, incluir transações recentes funcionará se a função datetime_date(YEAR,MONTH,DAY) for enviada de volta por push.
Amostra Você pode usar os métodos “Simples” ou “Complexo” para amostragem com pushback de SQL. Os diferentes métodos oferecem suporte ao pushback de SQL em diferentes graus.
  • O método de amostragem simples oferece suporte à geração de SQL em diferentes níveis, dependendo do banco de dados.
  • O método de amostragem Complex participa parcialmente do pushback do SQL. Parte do processamento inicial pode fazer parte do código SQL gerado. No entanto, alguns processos internos do fluxo de trabalho de amostragem não podem ser repassados ao banco de dados. Por exemplo, o plano de amostragem e a lógica de seleção resultam da execução CSPLAN dos procedimentos e CSSELECT . Como resultado, o nó Sample exibe o rótulo “SQL”, mas os nós a jusante são normalmente excluídos do pushback de SQL.

Selecionar Suporta geração apenas se a geração SQL para a própria expressão select for suportada. Se algum campo tiver nulos, a geração SQL não dará os mesmos resultados para descarte como são fornecidos em nativo SPSS Modeler.
Sort

No ` SPSS Modeler `, embora o nó `Sort` possa utilizar o `SQL pushback`, ele não inclui nenhuma ORDER BY cláusula na consulta SQL gerada. Essa limitação garante a compatibilidade entre diferentes sistemas de banco de dados.

No padrão SQL, uma tabela é representada como uma coleção não ordenada de linhas. As linhas não possuem uma sequência ou ordem inerente, a menos que seja explicitamente especificado. Como resultado, alguns otimizadores de banco de dados ignoram ORDER BY as cláusulas dentro de subconsultas, e muitos bancos de dados não permitem, de forma alguma, ORDER BY o uso de dentro de subconsultas.

Tabela 2. Suporte a geração de SQL no nó Amostra para amostragem simples
Modo Amostra Tamanho máximo Valor Inicial Db2 for z/OS DB2 for OS/400 Db2 for Win/UNIX Oracle SQL Server Teradata
Inclusão Primeiro n/d   Y Y Y Y Y Y
  1-em-n desligado   Y Y Y Y   Y
    máx   Y Y Y Y   Y
  % Aleatória desligado desligado Y   Y Y   Y
      em Y   Y Y    
    máx desligado Y   Y Y   Y
      em Y   Y Y    
Descartar Primeiro desligado         Y    
    máx         Y    
  1-em-n desligado   Y Y Y Y   Y
    máx   Y Y Y Y   Y
  % Aleatória desligado desligado Y   Y Y   Y
      em Y   Y Y    
    máx desligado Y   Y Y   Y
      em Y   Y Y    
Tabela 3. Suporte a geração de SQL no nó Agregado
Armazenamento Sum Média Mínimo Máx. Desvio padrão Mediana Contagem variância Percentil
Número Inteiro Y Y Y Y Y Y* Y Y Y*
Real Y Y Y Y Y Y* Y Y Y*
Data     Y Y   Y* Y   Y*
Hora     Y Y   Y* Y   Y*
Registro de data e hora     Y Y   Y* Y   Y*
Sequência     Y Y   Y* Y   Y*

* Mediana e percentil são suportados no Oracle.

Tabela 4. Nós de Operações de Campo
Nós que suportam a geração de SQL Notas
Anonimar Suporta de geração de SQL para Variável resposta contínuas e a geração de SQL parcial para Variáveis resposta Nominal ou de Flag.
Preparação Automática de Dados  
Categorização A geração de SQL é suportada se o método de binning Tiles (contagem igual) for usado e a opção Read from Bin Values (Ler da guia Valores de Bin), se disponível, for selecionada.

Devido às diferenças na maneira como os limites do compartimento são calculados (isso é causado pela natureza da distribuição dos dados nos campos do compartimento), você pode ver diferenças na saída do compartimento ao comparar os resultados de execução de fluxo normal e os resultados de SQL pushback. Para evitar isso, use o método de agrupamento Contagem de registros e os blocos Incluir no próximo ou Manter no atual para obter a correspondência mais próxima entre os dois métodos de execução de fluxo.

Derivar

A geração de SQL é suportada somente se o SQL gerado a partir da expressão derivada for válido.

No entanto, SPSS Modeler não poderá gerar SQL se você escolher State ou Count para a opção Derive as.

  • O STATE não pode ser traduzido para o SQL porque depende do rastreamento de estado persistente, com o qual o SQL não lida inerentemente.
  • O COUNT requer a manutenção de um total em execução, o que também não é suportado pelo SQL padrão.
Combinar Suporta a geração de SQL para Variáveis resposta contínuas. Para outros destinos, suporta a geração apenas se o método de conjunto de vitórias de confiança mais alta for usado.
Filler A geração de SQL é compatível se o SQL gerado a partir da expressão derivada for válido.
Filtro  
Partição Suportará a geração de SQL para designar registros para partições.
Reclassificar  
Reestruturação  
Análise RFM A geração de SQL é suportada se a opção Ler da guia Valores do compartimento se disponível estiver selecionada, mas os nós downstream não a suportarão.
Configurar para Sinalizador  
Tipo A geração de SQL é suportada somente se o nó Type for instanciado e nenhuma verificação de tipo ABORT ou WARN for especificada.
Tabela 5. Nós de Gráficos
Nós que suportam a geração de SQL Notas
Distribuição  
Avaliação  
Web  

Para alguns modelos, a SQL para o nugget do modelo pode ser gerada, enviando por push o estágio de escoragem de modelo de volta para o banco de dados. O principal uso desse recurso não é para melhorar o desempenho, mas para permitir que os fluxos que contêm esses nuggets tenham seu SQL completo retrocedido. Consulte “Geração de SQL a partir de fragmentos de modelo” para obter mais informações.

Tabela 6. nuggets do modelo
Nuggets do modelo que suportam a geração de SQL Notas
Previsor Categórico Automático Se um adaptador de escoragem de Função Definida pelo Usuário (UDF) estiver ativado, esses nuggets suportam SQL pushback. Além disso, se a geração de SQL para destinos contínuos ou o método de conjunto de vitórias de confiança mais alta forem usados, esses nuggets suportam o recebimento de dados de retrocesso adicional.
Previsor Contínuo Automático Se um adaptador de escoragem de Função Definida pelo Usuário (UDF) estiver ativado, esses nuggets suportam SQL pushback. Além disso, se a geração de SQL para destinos contínuos ou o método de conjunto de vitórias de confiança mais alta forem usados, esses nuggets suportam o recebimento de dados de retrocesso adicional.
CHAID  
C5.0  
Árvore C&R Suporta a geração de SQL para a opção de árvore única, mas não para as opções de boosting, bagging ou grandes conjuntos de dados.
Lista de Decisão  
Conjuntos de regras gerados  
Linear Um nugget de modelo linear gera SQL somente quando você seleciona a opção Score by converting to native SQL. Você pode usar a geração de SQL para a opção de modelo padrão, mas não para as opções de boosting, bagging ou conjunto de dados grande.
Logística Suporta a geração de SQL para procedimento Multinomial, mas não Binomial. Para Multinomial, a geração não é suportada quando as confidências são selecionadas, a menos que o tipo de destino seja Sinalizador.
Rede neural Um nugget do modelo Neural Net gera SQL somente quando você seleciona a opção Pontuação convertendo para SQL nativo. Você pode usar a geração de SQL para a opção de modelo padrão (somente Multilayer Perceptron), mas não para as opções de boosting, bagging ou large dataset.
PCA/Fator  
QUEST  
Tabela 7. Nós de saídas
Nós que suportam a geração de SQL Notas
Análise Suporta a geração, dependendo das opções selecionadas.
Matriz  
Relatório  
Configurar globais  
Estatísticas Oferece suporte à geração se a opção Correlate não for usada.
Tabela Suporta geração se a geração SQL é suportada para expressão de destaque.
Transformar