Propriedades de samplenode
O nó de Amostra seleciona um subconjunto de registros. É suportada uma variedade de tipos de amostra, incluindo
amostras estratificadas, em cluster e não aleatórias (estruturadas). A amostragem pode ser útil para melhorar o desempenho e para a seleção de grupos de registros ou transações relacionadas para análise.
Exemplo
/* Create two Sample nodes to extract
different samples from the same data */
node = stream.create("sample", "My node")
node.setPropertyValue("method", "Simple")
node.setPropertyValue("mode", "Include")
node.setPropertyValue("sample_type", "First")
node.setPropertyValue("first_n", 500)
node = stream.create("sample", "My node")
node.setPropertyValue("method", "Complex")
node.setPropertyValue("stratify_by", ["Sex", "Cholesterol"])
node.setPropertyValue("sample_units", "Proportions")
node.setPropertyValue("sample_size_proportions", "Custom")
node.setPropertyValue("sizes_proportions", [["M", "High", "Default"], ["M", "Normal", "Default"],
["F", "High", 0.3], ["F", "Normal", 0.3]])
propriedades samplenode |
Tipo de dados | Descrição da propriedade |
|---|---|---|
method |
Complexo Simples | |
mode |
Include Discard |
Inclui ou descarta registros que atendem a uma condição específica. |
sample_type |
First OneInN RandomPct |
Especifica o método de amostragem. |
first_n |
Número inteiro | Registros até o ponto de corte especificado a serem incluídos ou descartados. |
one_in_n |
number | Inclui ou descarta a cada nº registro. |
rand_pct |
number | Especifique a porcentagem de registros a incluir ou descartar. |
use_max_size |
sinalização | Ative o uso da configuração maximum_size. |
maximum_size |
Número inteiro | Especifica a maior amostra a ser incluída ou descartada do fluxo de dados. Essa opção é redundante e, portanto, desativada quando First e Include são especificados. |
set_random_seed |
sinalização | Permite o uso da configuração de valor inicial aleatório. |
random_seed |
Número inteiro | Especifica o valor utilizado como um valor inicial aleatório. |
complex_sample_type |
Random Systematic |
|
sample_units |
Proportions Counts |
|
sample_size_proportions |
Fixed Custom Variable |
|
sample_size_counts |
Fixed Custom Variable |
|
fixed_proportions |
number | |
fixed_counts |
Número inteiro | |
variable_proportions |
campo | |
variable_counts |
campo | |
use_min_stratum_size |
sinalização | |
minimum_stratum_size |
Número inteiro | Essa opção só se aplica quando uma amostra Complexa é tomada com Sample
units=Proportions. |
use_max_stratum_size |
sinalização | |
maximum_stratum_size |
Número inteiro | Essa opção só se aplica quando uma amostra Complexa é tomada com Sample
units=Proportions. |
clusters |
campo | |
stratify_by |
[field1 ... fieldN] | |
specify_input_weight |
sinalização | |
input_weight |
campo | |
new_output_weight |
sequência | |
sizes_proportions |
[[string string value][string string value]…] |
Se sample_units=proportions e sample_size_proportions=Custom, especifica um valor para cada combinação possível de valores de campos de estratificação. |
default_proportion |
number | |
sizes_counts |
[[string string value][string string value]…] |
Especifica um valor para cada combinação possível de valores de campo de estratificação. O uso é semelhante a sizes_proportions, mas especificando um número inteiro em vez de uma proporção. |
default_count |
number |