T_UMD_TEST 存储过程计算数字输入列的 Student t 统计,该列的值分为两类。计算目的是评估这两个类的均值之差的显著性。
语法
IDAX.T_UMD_TEST(in parameter_string varchar(32672))
参数描述
- parameter_string
- 必需的单字符串参数,其中包含以逗号分隔的 <parameter>=<value> 条目对。
- 数据类型:VARCHAR(32672)
- 以下列表显示参数值:
-
- intable
- 必需。
- 输入表的名称。
- 数据类型:VARCHAR(256)
- outtable
- 必需。
- 输出表的名称,Student t 统计将会写入其中。
- 输出表包含 T_UMD_TEST 列和 PERCENTAGE 列。
- 如果指定了 by 参数,那么将添加额外的 BY 列,以指出要针对哪个组计算 Student t 统计。
- T_UMD_TEST 列包含一个字符串,该字符串由 Student t 值和自由度组成。
- PERCENTAGE 列指出该列具有期望均值的概率:
- 如果百分比在 0 到 0.05 范围内,那么表明第二个类的均值明显大于第一个类。
- 如果百分比在 0.05 到 0.95 范围内,那么表明这两个类的均值相同。
- 如果百分比在 0.95 与 1 之间,那么表明第二个类的均值明显小于第一个类。
- 数据类型:VARCHAR(256)
- incolumn
- 必需。
- 输入表的数字列。
- 数据类型:VARCHAR(128)
- class
- 必需。
- 输入表的列,用于将数据拆为分两类。
- 在 CLASS 列的名称后,跟着以冒号 (:) 作为前缀的两个类值。
- 数据类型:VARCHAR(ANY)
- by
- 可选。
- 输入表的列,用于将数据拆分为多个要对其执行此存储过程的组。
- 缺省值:无
- 数据类型:VARCHAR(128)
返回的信息
DOUBLE:输入表的列的两个类具有类似均值的概率,或输出表中已计算 Student t 统计的组数目。
示例
CALL IDAX.T_UMD_TEST('intable=IRIS, incolumn=petallength,class=class:"virginica":"setosa", outtable=UMD_TEST_RESULT');