<model name>_COLUMNS 表

这个表包含所有供数据挖掘算法使用的列。

因此,您可以查看应用模型时需要哪些列。

这个表可能包含原始用户输入表中的列,以及自动转换选项以内部方式创建的列。应用模型时只需要原始列,因为转换后的值由评分算法确定。用于转换的参数值(例如,列的均值)包含在 <model name>_COLUMN_STATISTICS 中。某些挖掘函数只接受部分用法类型。

对于每个模型列,这个表均包含一行。

下表显示表列:

表 1. <model name>_COLUMNS 表的列
列名 数据类型 描述
COLUMNNAME(主键列) VARCHAR(128) 输入列的名称
DATATYPE VARCHAR(64) 列的 SQL 数据类型
OPTYPE VARCHAR(16) 列的操作类型

可能的值为 categoricalcontinuous

USAGETYPE VARCHAR(16) 用法类型 active
COLUMNWEIGHT DOUBLE 相对于其他列,对模型训练过程产生的影响的先验因子

缺省值为 1.0。

COMPAREFUNCTION VARCHAR(16) 用于比较一对列值的函数

可能的值为 absDiffequal

IMPORTANCE DOUBLE 指示该列对于数据挖掘模型的重要程度(由算法确定)

此值大于 0。

OUTLIERTREATMENT VARCHAR(16) 离群值处理

值为 asIs

LOWERLIMIT DOUBLE 数字字段中有效值的下限

Null 表示负无穷大。

UPPERLIMIT DOUBLE 数字字段中有效值的上限

Null 表示正无穷大。

CLOSURE VARCHAR(12) 指示离群值限制是否含括在有效值范围内

可能的值为 openClosedopenOpenclosedOpenclosedClosed

STATISTICSTYPE VARCHAR(16) 指示可用于该列的统计类型

可能的值如下所示:

discrete
<model name>_DISCRETE_STATISTICS 中获得的统计。
numeric
<model name>_NUMERIC_STATISTICS 中获得的统计。
column
<model name>_COLUMNS 中获得的统计。
null
没有可用的统计。