proprietà del nodo di campionamento
Il nodo Campione seleziona un sottoinsieme di record. Sono supportati vari tipi di campioni, inclusi campioni stratificati, raggruppati e non casuali (strutturati). Il campionamento può essere utile per migliorare le prestazioni e per selezionare gruppi di record o transazioni correlati per l'analisi.
Esempio
/* Create two Sample nodes to extract
different samples from the same data */
node = stream.create("sample", "My node")
node.setPropertyValue("method", "Simple")
node.setPropertyValue("mode", "Include")
node.setPropertyValue("sample_type", "First")
node.setPropertyValue("first_n", 500)
node = stream.create("sample", "My node")
node.setPropertyValue("method", "Complex")
node.setPropertyValue("stratify_by", ["Sex", "Cholesterol"])
node.setPropertyValue("sample_units", "Proportions")
node.setPropertyValue("sample_size_proportions", "Custom")
node.setPropertyValue("sizes_proportions", [["M", "High", "Default"], ["M", "Normal", "Default"],
["F", "High", 0.3], ["F", "Normal", 0.3]])
samplenode Proprietà |
Tipo di dati | Descrizione proprietà |
|---|---|---|
method |
Complesso semplice | |
mode |
Include Discard |
Includere o scartare i record che soddisfano la condizione specificata. |
sample_type |
First OneInN RandomPct |
Specifica il metodo di campionamento. |
first_n |
intero | I record fino al punto di interruzione specificato saranno inclusi o scartati. |
one_in_n |
numero | Includi o elimina ogni ennesimo record. |
rand_pct |
numero | Specificare la percentuale di record da includere o scartare. |
use_max_size |
indicatore | Abilita l'uso dell'impostazione " maximum_size ". |
maximum_size |
intero | Specificare il campione più grande da includere o scartare dal flusso di dati. Questa opzione è ridondante e quindi disabilitata quando vengono specificati First e Include . |
set_random_seed |
indicatore | Consente l'uso dell'impostazione del seed casuale. |
random_seed |
intero | Specificare il valore utilizzato come seme casuale. |
complex_sample_type |
Random Systematic |
|
sample_units |
Proportions Counts |
|
sample_size_proportions |
Fixed Custom Variable |
|
sample_size_counts |
Fixed Custom Variable |
|
fixed_proportions |
numero | |
fixed_counts |
intero | |
variable_proportions |
campo | |
variable_counts |
campo | |
use_min_stratum_size |
indicatore | |
minimum_stratum_size |
intero | Questa opzione si applica solo quando un esempio complesso viene preso con Sample
units=Proportions. |
use_max_stratum_size |
indicatore | |
maximum_stratum_size |
intero | Questa opzione si applica solo quando un esempio complesso viene preso con Sample
units=Proportions. |
clusters |
campo | |
stratify_by |
[field1 ... fieldN] | |
specify_input_weight |
indicatore | |
input_weight |
campo | |
new_output_weight |
stringa | |
sizes_proportions |
[[string string value][string string value ]…] |
Se sample_units=proportions e sample_size_proportions=Custom, specifica un valore per ogni possibile combinazione di valori dei campi di stratificazione. |
default_proportion |
numero | |
sizes_counts |
[[string string value][string string value ]…] |
Specifica un valore per ogni possibile combinazione di valori dei campi di stratificazione. L'utilizzo è simile a sizes_proportions ma specificando un numero intero anziché una proporzione. |
default_count |
numero |