propriedades hdbscannode

Ícone do nó HDBSCANO Hierarchical Density-Based Spatial Clustering (HDBSCAN)© usa o aprendizado não supervisionado para localizar clusters ou regiões densas de um conjunto de dados. O nó HDBSCAN no SPSS Modeler expõe os recursos principais e parâmetros comumente usados da biblioteca HDBSCAN. O nó é implementado no Python e é possível usá-lo para agrupar seu conjunto de dados em grupos distintos quando não sabe o que esses grupos são a princípio.

Tabela 1. propriedades hdbscannode
propriedades hdbscannode Tipo de dados Descrição da propriedade
custom_fields Booleano Essa opção instrui o nó a utilizar as informações de campo especificadas aqui ao invés das informações fornecidas em qualquer nó ou nós Tipo de envio de dados. Após selecionar essa opção, especifique os campos a seguir conforme necessário.
inputs campo Campos de entrada para clusterização.
useHPO Booleano Especifique true ou false para ativar ou desativar o Hyper-Parameter Optimization (HPO) baseado em Rbfopt, que descobre automaticamente a combinação ideal de parâmetros para que o modelo atinente a taxa de erro esperada ou menor nas amostras. O padrão é false.
min_cluster_size Número inteiro O tamanho mínimo de clusters. Especifique um inteiro. O padrão é 5.
min_samples Número inteiro O número de amostras em uma vizinhança para um ponto a ser considerado um ponto principal. Especifique um inteiro. Se configurado como 0, o min_cluster_size é usado. O padrão é 0.
algorithm sequência Especifique qual algoritmo usar: best, generic, prims_kdtree, prims_balltree, boruvka_kdtree ou boruvka_balltree. O padrão é best.
metric sequência Especifique qual métrica usar ao calcular distância entre instâncias em uma matriz de recursos: euclidean, cityblock, L1, L2, manhattan, braycurtis, canberra, chebyshev, correlation, minkowski ou sqeuclidean. O padrão é euclidean.
useStringLabel Booleano Especifique true para usar um rótulo de cluster de sequência ou false para usar um rótulo de cluster de número. O padrão é false.
stringLabelPrefix sequência Se o parâmetro useStringLabel for configurado como true, especifique um valor para o prefixo do rótulo de sequência. O prefixo padrão é cluster.
approx_min_span_tree Booleano Especifique true para aceitar uma árvore de amplitude mínima aproximada ou false se você estiver disposto a sacrificar a velocidade para correção. O padrão é true.
cluster_selection_method sequência Especifique o método a ser usado para selecionar clusters na árvore condensada: eom ou leaf. O padrão é eom (algoritmo Excesso de massa).
allow_single_cluster Booleano Especifique true se você deseja permitir resultados de cluster únicos. O patrão é false.
p_value duplo Especifique o p value para usar se você estiver usando minkowski para a métrica. O padrão é 1.5.
leaf_size Número inteiro Se usar um algoritmo de árvore espacial (boruvka_kdtree ou boruvka_balltree), especifique o número de pontos em um nó de folha da árvore. O padrão é 40.
outputValidity Booleano Especifique true ou false para controlar se o gráfico Índice de validade está incluído na saída do modelo.
outputCondensed Booleano Especifique true ou false para controlar se o gráfico de Árvore condensada está incluído na saída do modelo.
outputSingleLinkage Booleano Especifique true ou false para controlar se o gráfico Árvore de ligação única está incluído na saída do modelo.
outputMinSpan Booleano Especifique true ou false para controlar se o gráfico Árvore de abrangência mínima está incluído na saída do modelo.
is_split