Níveis de medição

A medida, também conhecida como nível de medição, descreve o uso de campos de dados no SPSS Modeler.

É possível especificar o Medida nas propriedades do nó de um nó de importação ou um nó Tipo. Por exemplo, é possível configurar a medida de um campo de número inteiro com valores de 1 e 0para Sinalizador. Isso geralmente indica que 1 = True e 0 = False.

Armazenamento versus medição. Observe que o nível de medição de um campo é diferente de seu tipo de armazenamento, que indica se os dados são armazenados como sequência de caracteres, número inteiro, número real, data, horário ou registro de data e hora. Embora seja possível modificar os tipos de dados em qualquer ponto de um fluxo usando um nó Tipo, o armazenamento deve ser determinado na origem ao ler os dados (embora você possa mudá-lo subsequentemente usando uma função de conversão).

Os níveis de medida a seguir estão disponíveis:
  • Padrão. Dados cujo tipo de armazenamento e valores são desconhecidos (por exemplo, porque ainda não foram lidos) são exibidos como Padrão.
  • Contínuo. Usado para descrever valores numéricos, como um intervalo de 0 a100 ou 0.75 a 1.25. Um valor contínuo pode ser um número inteiro, número real ou data/hora.
  • Categórico. Usado para valores de sequência de caracteres quando um número exato de valores distintos é desconhecido. Este é um tipo de dados não instanciado, o que significa que todas as informações possíveis sobre o armazenamento e uso dos dados ainda não são conhecidas. Após os dados serem lidos, o nível de medição será Flag, Nominalou Typeless, dependendo do número máximo de membros para campos nominais especificados.
  • Sinalizador. Usado para dados com dois valores distintos que indicam a presença ou ausência de um traço, como true e false, Yes e No, ou 0 e 1. Os valores usados podem variar, mas um deve ser sempre designado como valor "true" e o outro como valor "false". Os dados podem ser representados como texto, número inteiro, número real, data, hora ou registro de data e hora.
  • Nominal. Usado para descrever dados com vários valores distintos, cada um tratado como membro de um conjunto, como small/medium/large. Os dados nominais podem ter qualquer armazenamento—numérico, sequência de caracteres ou data/hora. Note que configurar o nível de medição para Nominal não muda automaticamente os valores para armazenamento de sequência de caracteres.
  • Ordinal. Usado para descrever dados com vários valores distintos que possuem uma ordem inerente. Por exemplo, categorias de salário ou ranqueamentos de satisfação podem ser digitados como dados ordinais. A ordem é definida pela ordem de ordenação natural dos elementos de dados. Por exemplo, 1, 3, 5 é a ordem de classificação padrão para um conjunto de números inteiros, enquanto HIGH, LOW, NORMAL (crescente alfabeticamente) é a ordem para um conjunto de strings. O nível de medição ordinal permite definir um conjunto de dados categóricos como dados ordinais para fins de visualização, construção de modelo e exportação para outros aplicativos (como IBM SPSS Statistics) que reconhecem dados ordinais como um tipo distinto. Você pode usar um campo ordinal em qualquer lugar em que um campo nominal pode ser usado. Além disso, campos de qualquer tipo de armazenamento (real, número inteiro, sequência de caracteres, data, hora e assim por diante) pode ser definido como ordinal.
  • Sem tipo. Utilizado para dados que não são adequados a qualquer um dos tipos Padrão, Contínuo, Categórico, Sinalizador, Nominal ou Ordinal, para campos com um único valor, ou para dados nominais em que o conjunto tenha mais membros do que o máximo definido. Sem tipo também é útil para casos em que o nível de medição seria um conjunto com muitos membros (como um número de conta). Quando você seleciona Sem tipo para um campo, a função é automaticamente configurada como Nenhuma, com ID de registro como a única alternativa. O tamanho máximo padrão para conjuntos é de 250 valores exclusivos.
  • Coleção. Usado para identificar dados não geoespaciais que são registrados em uma lista. Uma coleta é efetivamente um campo de lista de zero de profundidade, em que os elementos nessa lista têm um dos outros níveis de medição.
  • Geoespacial. Usado com o tipo Listar armazenamento para identificar dados geoespaciais. As listas podem ser campos de Lista de inteiro ou Lista de real com uma profundidade de lista entre zero e dois, inclusive.

É possível especificar manualmente os níveis de medição ou permitir que o software leia os dados e determine o nível de medição com base nos valores que lê. Como alternativa, quando você tiver vários campos de dados contínuos que devem ser tratados como dados categóricos, será possível escolher uma opção para convertê-los. Veja Convertendo dados contínuos.

Para usar a digitação automática

  1. Em um nó Tipo, defina a coluna Modo de valor como Leitura para os campos desejados. Isso tornará os metadados disponíveis para todos os nós de recebimento de dados.
  2. Clique em Ler Valores para ler valores da origem de dados imediatamente.

Para configurar manualmente o nível de medição para um campo

  1. Selecione um campo na tabela.
  2. A partir do menu suspenso na coluna Medida, selecione um nível de medição para o campo.
  3. Como alternativa, é possível usar as caixas de seleção para selecionar vários campos e, em seguida, usar a lista suspensa de nível superior para definir o nível de medição para todos os campos selecionados de uma vez.