propriedades hdbscannode
O Hierarchical Density-Based Spatial Clustering (HDBSCAN)© usa o aprendizado não supervisionado para localizar clusters ou regiões densas de um conjunto de dados. O nó HDBSCAN no SPSS Modeler expõe os recursos principais e parâmetros comumente usados da biblioteca HDBSCAN. O nó é implementado no Python e é possível usá-lo para agrupar seu conjunto de dados em grupos distintos quando não sabe o que esses grupos são a princípio.
propriedades hdbscannode |
Tipo de dados | Descrição da propriedade |
|---|---|---|
| custom_fields | Booleano | Essa opção instrui o nó a utilizar as informações de campo especificadas aqui ao invés das informações fornecidas em qualquer nó ou nós Tipo de envio de dados. Após selecionar essa opção, especifique os campos a seguir conforme necessário. |
inputs |
campo | Campos de entrada para clusterização. |
useHPO |
Booleano | Especifique true ou false para ativar ou desativar o Hyper-Parameter Optimization (HPO) baseado em Rbfopt, que descobre automaticamente a combinação ideal de parâmetros para que o modelo atinente a taxa de erro esperada ou menor nas amostras. O padrão é false. |
min_cluster_size |
Número inteiro | O tamanho mínimo de clusters. Especifique um inteiro. O padrão é 5. |
min_samples |
Número inteiro | O número de amostras em uma vizinhança para um ponto a ser considerado um ponto principal. Especifique um inteiro. Se configurado como 0, o min_cluster_size é usado. O padrão é 0. |
algorithm |
sequência | Especifique qual algoritmo usar: best, generic, prims_kdtree, prims_balltree, boruvka_kdtree ou boruvka_balltree. O padrão é best. |
metric |
sequência | Especifique qual métrica usar ao calcular distância entre instâncias em uma matriz de recursos: euclidean, cityblock, L1, L2, manhattan, braycurtis, canberra, chebyshev, correlation, minkowski ou sqeuclidean. O padrão é euclidean. |
useStringLabel |
Booleano | Especifique true para usar um rótulo de cluster de sequência ou false para usar um rótulo de cluster de número. O padrão é false. |
stringLabelPrefix |
sequência | Se o parâmetro useStringLabel for configurado como true, especifique um valor para o prefixo do rótulo de sequência. O prefixo padrão é cluster. |
approx_min_span_tree |
Booleano | Especifique true para aceitar uma árvore de amplitude mínima aproximada ou false se você estiver disposto a sacrificar a velocidade para correção. O padrão é true. |
cluster_selection_method |
sequência | Especifique o método a ser usado para selecionar clusters na árvore condensada: eom ou leaf. O padrão é eom (algoritmo Excesso de massa). |
allow_single_cluster |
Booleano | Especifique true se você deseja permitir resultados de cluster únicos. O patrão é false. |
p_value |
duplo | Especifique o p value para usar se você estiver usando minkowski para a métrica. O padrão é 1.5. |
leaf_size |
Número inteiro | Se usar um algoritmo de árvore espacial (boruvka_kdtree ou boruvka_balltree), especifique o número de pontos em um nó de folha da árvore. O padrão é 40. |
outputValidity |
Booleano | Especifique true ou false para controlar se o gráfico Índice de validade está incluído na saída do modelo. |
outputCondensed |
Booleano | Especifique true ou false para controlar se o gráfico de Árvore condensada está incluído na saída do modelo. |
outputSingleLinkage |
Booleano | Especifique true ou false para controlar se o gráfico Árvore de ligação única está incluído na saída do modelo. |
outputMinSpan |
Booleano | Especifique true ou false para controlar se o gráfico Árvore de abrangência mínima está incluído na saída do modelo. |
is_split |