Nó de Partição
Os nós de partição são usados para gerar um campo de partição que divide os dados em subconjuntos ou amostras separados para os estágios de treinamento, de teste e de validação da construção de modelo. Ao utilizar uma amostra para gerar o modelo e uma amostra separada para testá-lo, é possível obter uma boa indicação do quão bem o modelo será generalizado para conjuntos de dados maiores que forem semelhantes aos dados atuais.
O nó Partição gera um campo nominal com o papel configurado como Partição. Como alternativa, se um campo apropriado já existir em seus dados, ele poderá ser designado como uma partição utilizando um nó Tipo. Nesse caso, nenhum nó Partição separado é necessário. Qualquer campo nominal instanciado com dois ou três valores pode ser utilizado como uma partição, mas os campos de flag não podem ser utilizados.
Vários campos de partição podem ser definidos em um fluxo, mas se assim for, um único campo de partição deve ser selecionado em cada nó de modelagem que usa particionamento. (Se apenas uma partição estiver presente, ela será utilizada automaticamente sempre que o particionamento estiver ativado).
Para criar um campo de partição com base em algum outro critério, como um intervalo de data ou localização, também é possível utilizar um nó Derivar. Veja Derivar nó para obter mais informações.
Exemplo, Ao construir um fluxo RFM para identificar clientes recentes que responderam positivamente às campanhas de marketing anteriores, o departamento de marketing de uma empresa de vendas usa um nó de partição para dividir os dados em partições de treinamento e teste.