Configurando propriedades para fluxos
É possível especificar propriedades para aplicar ao fluxo atual.
Para configurar as propriedades do fluxo, clique no ícone Propriedades do fluxo ![]()
É possível configurar as propriedades a seguir:
Opção
- Geral
- Número máximo de linhas a serem mostradas na visualização de dados
- Ao visualizar os dados para um nó, é possível especificar o número de linhas a serem mostradas.
- Limitar os membros para campos nominais
- O tipo de dados dos campos nominais (conjunto) se torna Sem Tipo quando o número de membros excede o número máximo de membros que você configurou em Máximo de Membros. Essa opção é útil quando você está trabalhando com campos nominais grandes Quando o nível de medida de um campo é configurado como Sem Tipo, sua função é configurada automaticamente como Nenhum Os campos configurados como Nenhum não estão disponíveis para modelagem.
- Data/hora
- Data / hora/registro de data e hora de importação como
- Selecione se deseja usar um formato de data e hora para armazenar dados em campos de data e hora ou se deseja importá-los como variáveis de sequência.
- Usar microssegundos nos campos de registro de data e hora
- Se você tiver dados de registro de data e hora medidos em microssegundos, será possível ativar essa opção para usar os dados mais precisos em seus fluxos. Para ativar a opção, marque essa caixa de seleção e Sequência para a configuração de Importar data / hora/registro de data e hora comoObservação: Essa opção funciona somente para conectores que suportam pushback de SQL.
- Formato de data
- Selecione um formato de data a ser usado para campos de armazenamento de data ou quando as strings são interpretadas como datas pelas funções de data do CLEM.
- Formato de hora
- Selecione um formato de hora a ser usado para campos de armazenamento de horário ou quando as strings são interpretadas como horas pelas funções de hora do CLEM.
- Rolar dias/min.
- Para formatos de hora, selecione se as diferenças de tempo negativas são interpretadas como referindo-se ao dia ou hora anterior.
- Referência de data (1º de janeiro)
- Selecione os anos da linha de base (sempre 1 de janeiro) a serem usados pelas funções de data do CLEM que funcionam com uma única data.
- Iniciar a partir de datas com dois dígitos
- Especifique o ano de corte para incluir dígitos de século para anos que são denotados com apenas 2 dígitos. Por exemplo, especificando 1930 como ano de corte significa que 11/05/02 é no ano 2002. A mesma configuração usará o século 20 para datas após o ano 30; assim, 05/11/73 será assumido como 1973.
- Fuso horário
- Selecione como o fuso horário é escolhido para uso com a expressão
datetime_nowdo CLEM.- Se você selecionar Servidor, o fuso horário será usado de onde o tempo de execução do SPSS Modeler está em execução (às vezes esse tempo é o mesmo que a opção Cliente ). Ou se seu fluxo usar dados de um banco de dados e o banco de dados suportado usar SQL pushback, a expressão
datetime_nowusará o horário do banco de dados. - Se você selecionar Cliente, o fuso horário é usado a partir da máquina em que o SPSS Modeler está instalado.
- Alternativamente, é possível selecionar qualquer valor de Hora Universal Coordenada para o fuso horário.
- Se você selecionar Servidor, o fuso horário será usado de onde o tempo de execução do SPSS Modeler está em execução (às vezes esse tempo é o mesmo que a opção Cliente ). Ou se seu fluxo usar dados de um banco de dados e o banco de dados suportado usar SQL pushback, a expressão
- Formatos de números
- É possível especificar o número de casas decimais a serem usadas quando o SPSS Modeler exibe números reais nos formatos de exibição padrão, científico ou de moeda
- Otimização
- É possível usar essas configurações para otimizar o desempenho do fluxo.
- Ativar a nova gravação de fluxo
- A reescrita de fluxo reordena os nós em um fluxo nos bastidores para uma operação mais eficiente, sem alterar a semântica do fluxo.
- Otimizar expressões CLEM
- Essa opção permite que o otimizador procure por expressões CLEM que possam ser pré-processadas antes que o fluxo seja executado para aumentar a velocidade de processamento Por exemplo, se você tiver uma expressão como
log(salary), o otimizador calculará o valor de salário real e transmitirá esse valor para processamento Essa opção pode ser usada para melhorar o desempenho de SQL pushback e do SPSS Modeler - Otimizar execução de sintaxe
- Esse método de regravação de fluxo aumenta a eficiência de operações que possuem mais do que um nó que contém a sintaxe do SPSS Statistics A otimização é obtida combinando os comandos de sintaxe em uma única operação, em vez de executar cada um como uma operação separada.
- Otimizar outra execução
- Este método de reescrita de fluxo aumenta a eficiência das operações que não podem ser delegadas ao banco de dados. A otimização é obtida reduzindo a quantidade de dados no fluxo o mais cedo possível. O fluxo é regravado para enviar por push operações mais próximas da origem de dados enquanto mantém a integridade de dados.. Essa mudança reduz o recebimento de dados para operações caras, como junções.
- Ativar processamento paralelo
- Ao executar em um computador com vários processadores, essa opção permite que o sistema equilibre a carga entre esses processadores, o que pode resultar em desempenho mais rápido. O uso de vários nós ou o uso dos nós individuais a seguir podem se beneficiar do processamento paralelo: C5.0, Mesclagem (por chave), Classificação, Bin (métodos de classificação e ladrilho) e Agregado (usando um ou mais campos-chave).
- Gerar SQL
- Esta opção empurra o processamento de SQL de volta para o banco de dados. Ativar ou desativar essa opção afeta apenas os novos fluxos criados. Não é possível alternar a configuração para um fluxo existente Para obter mais informações sobre como usar essa opção com fluxos, consulte Otimização de SQL
- Armazenamento em cache do banco de dados (somente SQL). Para fluxos que geram SQL para serem executados no banco de dados, os dados podem ser armazenados em cache no meio do fluxo para uma tabela temporária no banco de dados em vez de para o sistema de arquivos. Quando combinada com a otimização de SQL, essa opção pode resultar em ganhos significativos no desempenho Por exemplo, a saída de um fluxo que mescla várias tabelas para criar uma visualização de mineração de dados pode ser armazenada em cache e reutilizada conforme necessário. Com o cache do banco de dados ativado, passe o mouse sobre qualquer nó não terminal em seu fluxo e, em seguida, clique no menu overflow
e selecione . Os dados agora são armazenados em cache nesse nó e o cache é criado automaticamente diretamente no banco de dados na próxima vez em que o fluxo for executado Isso permite que o SQL seja gerado para nós de recebimento de dados, melhorando ainda mais o desempenho. Alternativamente, essa opção pode ser desativada se for necessário, como quando políticas ou permissões impedem que dados sejam gravados no banco de dados. Se o armazenamento em cache do banco de dados ou a otimização de SQL não estiver ativada, o cache será gravado no sistema de arquivos. - Usar conversão relaxada (somente SQL). Esta opção permite a conversão de dados de sequências de caracteres em números, ou de números em sequências de caracteres, se eles estiverem armazenados em um formato adequado. Por exemplo, se os dados forem mantidos no banco de dados como uma sequência de caracteres, mas de fato contiverem um número significativo, os dados poderão ser convertidos para uso quando ocorrer um retrocesso.
- Armazenamento em cache do banco de dados (somente SQL). Para fluxos que geram SQL para serem executados no banco de dados, os dados podem ser armazenados em cache no meio do fluxo para uma tabela temporária no banco de dados em vez de para o sistema de arquivos. Quando combinada com a otimização de SQL, essa opção pode resultar em ganhos significativos no desempenho Por exemplo, a saída de um fluxo que mescla várias tabelas para criar uma visualização de mineração de dados pode ser armazenada em cache e reutilizada conforme necessário. Com o cache do banco de dados ativado, passe o mouse sobre qualquer nó não terminal em seu fluxo e, em seguida, clique no menu overflow
- Esta opção empurra o processamento de SQL de volta para o banco de dados. Ativar ou desativar essa opção afeta apenas os novos fluxos criados. Não é possível alternar a configuração para um fluxo existente Para obter mais informações sobre como usar essa opção com fluxos, consulte Otimização de SQL
- Criação de log
- Exibir SQL no log de mensagens no tempo de execução
- Especifica se o SQL gerado durante a execução do fluxo é passado para o log de mensagens.
- Exibir geração de SQL no log de mensagem durante a preparação
- Especifica se o SQL gerado durante a execução do fluxo é passado para o log de mensagens.
- Formato SQL
- Especifica se qualquer SQL exibido no log deve conter funções SQL nativas ou funções ODBC padrão do formulário
{fn FUNC(…)}, conforme gerado pelo SPSS Modeler. O último conta com a funcionalidade do driver ODBC que pode não estar implementada. - Reformatar SQL para maior facilidade de leitura
- Especifica se a SQL exibida no log deve ser formatada para capacidade de leitura.
- Mostrar status de registros
- Especifica quando os registros devem ser relatados conforme eles chegam aos nós terminais. Especifique um número para usar para atualizar o status a cada N registros.
Parâmetros
Parâmetros são variáveis definidas pelo usuário que são salvas e persistidas com o fluxo atual ou SuperNode. Os parâmetros geralmente são usados no script para controlar o comportamento do script e podem ser acessados a partir da interface com o usuário também.É possível definir parâmetros para uso em expressões do CLEM e em scripts. Os parâmetros definidos nas propriedades de fluxo estão disponíveis para todos os nós no fluxo. Os parâmetros configurados para um SuperNode não estão disponíveis fora do SuperNode Se você salvar um fluxo, quaisquer parâmetros configurados para esse fluxo também serão salvos.
Para obter mais informações sobre parâmetros, consulte Fluxo e parâmetros SuperNode.
Clique em Incluir valor e insira as seguintes informações para o novo parâmetro:
- Nome
- Este nome é como o parâmetro é referenciado nas expressões. Por exemplo, para criar um parâmetro para uma temperatura mínima, você poderia inserir minvalue
Quando os parâmetros são usados em expressões CLEM, eles são colocados entre aspas simples, por exemplo,
'$P-minvalue'Não insira o prefixo$P-.. Ele denota um parâmetro em expressões CLEM - Rótulo
- Lista um nome descritivo para cada parâmetro criado.
- Armazenamento
- Armazenamento indica como valores de dados são armazenados no parâmetro. Por exemplo, se os valores tiverem zeros iniciais que você deseja preservar (como
008), selecione Sequência como o tipo de armazenamento. Caso contrário, os zeros serão removidos do valor. - Valor
- Lista o valor atual para cada parâmetro, que pode ser alterado conforme necessário.. Os valores para parâmetros de data devem ser especificados na notação padrão ISO (AAAA-MM-DD).
- Medida
- Selecione o nível de medição, que é usado para descrever as características do parâmetro. É possível alterar esse valor para refletir a maneira com que você pretende usar o parâmetro.. Por exemplo, Typeless indica que o parâmetro pode ter qualquer valor compatível com seu armazenamento.
- Prompt?
- Selecione essa opção se desejar que os usuários sejam solicitados a inserir um valor para esse parâmetro quando iniciarem o tempo de execução. É possível usar essa opção em que você pode precisar inserir valores diferentes para o mesmo parâmetro em ocasiões diferentes
Globais
Na guia Globais das propriedades de fluxo, é possível visualizar os valores globais configurados para o fluxo atual. Os valores globais são criados usando um nó Configurar Globais para determinar estatísticas como média, soma ou desvio padrão para campos selecionados.
Depois que um nó Configurar Globais é executado, esses valores se tornam disponíveis para vários usos em operações de fluxo
Não é possível editar valores globais na tabela aqui nas propriedades de fluxo, mas é possível limpar todos os valores globais para um fluxo..
Anotações
Se você precisar descrever um fluxo para outras pessoas em sua organização, será possível anexar comentários explicativos a fluxos, nós e nuggets do modelo Outros podem então visualizar esses comentários na tela ou até mesmo imprimir uma imagem do fluxo que inclui seus comentários.
Use a guia Anotações das propriedades de fluxo para adicionar anotações de texto ao seu fluxo. Essas notas são visíveis apenas quando a guia Anotações está aberta, exceto que anotações de fluxo também podem ser mostradas como comentários em tela.