<model name>_COLUMN_STATISTICS 表

この表にはクラスターごとに 1 行が含まれます。

以下の表に、表の列を示します。

表 1. <model name>_COLUMN_STATISTICS 表の列
列名 データ型 説明
CLUSTERID (主キー列) INTEGER クラスター・モデル内のクラスターのインデックス値

CLUSTERID が 0 の場合、行はすべての入力レコードに適用されます。

COLUMNNAME (主キー列) VARCHAR(128) 入力列の名前
CARDINALITY BIGINT 個別値の数

列が連続型の場合、この値は NULL です。

MODE VARCHAR (16000) CLUSTERID の列の最も頻繁な離散型値。
MINIMUM DOUBLE 最小値

列が数値でない場合、値は NULL です。

MAXIMUM DOUBLE 最大値

列が数値でない場合、値は NULL です。

MEAN DOUBLE 平均値

列が数値でない場合、値は NULL です。

VARIANCE DOUBLE 不偏サンプル分散

列が数値でない場合、値は NULL です。

VALIDFREQ BIGINT 有効値の数
MISSINGFREQ BIGINT 欠損値の数
INVALIDFREQ BIGINT 無効値の数
IMPORTANCE DOUBLE 正規化済みのカイ二乗値

この値は、クラスター内の列分布が全体の列分布と異なっているかどうかを示します。正規化済みのカイ二乗値とは、カイ二乗値と、(自由度を考慮した) 99.99% の有意性に十分なカイ二乗値との間の差異を示す因子です。