使用此儲存程序來列印模型,以取得其最重要性質的摘要。因此,您會取得模型的快速概觀。
權限
陳述式的授權 ID 所持有的專用權必須至少包含下列其中一項權限:
- 來源模型的 SELECT 專用權
- DATAACCESS 權限
語法
IDAX.PRINT_MODEL(in parameter_string varchar(32672))
參數說明
- parameter_string
- 必要的單一字串參數,其中包含以逗點區隔的 <parameter>=<value> 項目配對。
- 資料類型:VARCHAR(32672)
- 下列清單顯示參數值:
-
- model
- 必要。
- 要列印的模型名稱。
- 您可以使用綱目名稱來限定 model 參數的值,如下所示:
<schema name>.<model name>
傳回的資訊
作為結果集的輸出。
結果集的結構取決於模型類型(亦即演算法),以及模型表格的格式和內容。
下列儲存程序具有其他參數,並顯示特定的傳回資訊。演算法會按字母順序列出。
範例
CALL IDAX.PRINT_MODEL('model=cc_nb_ewd');
關聯規則模型的其他參數
- outtable
- 選用。
- 在其中寫入型樣和規則的模型表格名稱。
- 預設值:none
- 資料類型:VARCHAR(128)
- 如果未指定任何值,則只會列印型樣或規則。
- type
- 選用。
- 要顯示的資訊類型。
- 預設值:"rules"
- 可能值為 "rules" 和 "patterns"。
- 資料類型:VARCHAR(8)
- limit
- 選用。
- 顯示的規則或型樣之數目上限。
- 預設值:none
- 範圍:>=1
- 資料類型:INTEGER
- 如果未指定任何值,則會顯示所有規則或型樣。
- itemsin
- 選用。
- 必須包含在所顯示的規則或型樣中的項目名稱清單。項目以分號區隔。至少必須包含其中一個列出的項目。
- 預設值:none
- 資料類型:VARCHAR(32000)
- 如果指定了 type=rules 參數,則下列條件適用:
- 若要指出該項目必須包含在規則標頭中,則項目名稱後面可以加上 :h 或 :head。
- 若要指出該項目必須包含在規則主體中,則項目名稱後面可以加上 :b 或 :body。
- 如果未指定此參數,則不會套用任何限制。
- itemsout
- 選用。
- 不得包含在所顯示的規則或型樣中的項目名稱清單。項目以分號區隔。
- 預設值:none
- 資料類型:VARCHAR(32000)
- 如果未指定此參數,則不會套用任何限制。
- minlen
- 選用。
- 要顯示在規則或型樣中的最小項目數。
- 預設值:1
- 範圍:>= 1 且 <= maxlen
- 資料類型:INTEGER
- maxlen
- 選用。
- 要顯示在規則或型樣中的項目數上限。
- 預設值:模型的最長型樣
- 範圍:>= minlen
- 資料類型:INTEGER
- minsupport
- 選用。
- 要顯示在規則或型樣中的項目的最小支持度。
- 預設值:0.0
- 範圍:>=0.0 且 <=maxsupport
- 資料類型:DOUBLE
- maxsupport
- 選用。
- 要顯示在規則或型樣中的項目的最大支持度。
- 預設值:1.0
- 範圍:>=minsupport 且 <=1.0
- 資料類型:DOUBLE
- minlift
- 選用。
- 要顯示的規則或型樣的最小提升率。
- 預設值:0.0
- 範圍:>=0.0 且 <=maxlift
- 資料類型:DOUBLE
- maxlift
- 選用。
- 要顯示的規則或型樣的最大提升率。
- 預設值:模型型樣的最大提升率
- 範圍:>=minlift
- 資料類型:DOUBLE
- minconf
- 選用。
- 要顯示的規則的最小信賴度。
- 預設值:0.0
- 資料類型:DOUBLE
- 範圍:>=0.0 且 <= maxconf
- 唯有指定了 type=rules 參數,您才能指定此參數。
- maxconf
- 選用。
- 要顯示的規則的最大信賴度。
- 預設值:1.0
- 資料類型:DOUBLE
- 範圍:>=minconf 且 <= 1.0
- 唯有指定了 type=rules 參數,您才能指定此參數。
- sort
- 選用。
- 指出規則或型樣顯示順序的關鍵字清單。清單的順序是遞減。項目以分號區隔。
- 可能值為 "support"、"confidence"、"lift" 及 "length"。
- 如果指定了 type=rules 參數,則為預設值:
support;confidence;length
- 如果指定了 type=patterns 參數,則為預設值:
support;lift;length
- 資料類型:VARCHAR(32000)
針對關聯規則的傳回資訊
結果集包含所有規則或型樣,它們依 sort 參數中指定之順序符合所定義的限制項。
如果指定 outtable 參數,則會建立與結果集具有相同內容的輸出表格。
K-means 模型的其他參數
- clusters
- 選用。
- 要列印之模型的叢集 ID。
- 叢集 ID 會以分號 (;) 區隔。
- 如果未指定 clusters,則會列印所有叢集的叢集 ID。
- columns
- 選用。
- 要列印之模型的輸入直欄名稱。
- 輸入直欄名稱會以分號 (;) 區隔。
- 如果未指定 columns,則會列印所有輸入直欄的輸入直欄名稱。
- mode
- 選用。
- 決定要列印的模型資訊的模式。
- 容許的值為 preview、clusters、centers、statistics。
- 如果指定 mode=preview,則輸出會顯示一個表格,其中每一個輸入直欄各有一列。此表格具有每一個叢集及整體資料的 mean(對於數值輸入直欄)和 mode(對於名義輸入直欄)直欄,且每一個叢集的大小各有一列。
- 如果指定 mode=clusters,則輸出會顯示一個表格,其中每個叢集各有一列,並有 clusterid、name、size、withinss 及 description 直欄。
- 如果指定 mode=centers,則輸出會顯示一個表格,其中每個叢集的每個輸入直欄各有一列。此表格具有下列直欄:clusterid、columnname、cardinality、mode、
minimum、maximum、mean、variance、count 及 importance。如果模型是以 statistics=none 建置,則此表格具有 clusterid 、columnname、mode(對於名義輸入直欄)及 mean(對於數值輸入直欄)直欄。
- 如果 mode=statistics,則輸出會顯示一個表格,其中輸入直欄的每個值及每個叢集各有一列,並有 clusterid、columnname、value、count、relfrequency、deviation、mean 及 variance 直欄。如果是以 statistics=none 或 statistics=columns 來建置模型,則表格是空的。
針對 k-最近鄰法 (KNN) 的傳回資訊
結果集包含直欄內容表格,其說明模型表格的 ID、目標及輸入直欄。會收集所有輸入直欄的統計資料。
表 1. 結果集直欄
| 直欄名稱 |
直欄類型 |
說明 |
| COLNO |
INTEGER |
表格中直欄的等級 |
| NAME |
VARCHAR(128) |
直欄的名稱 |
| SQLTYPE |
VARCHAR(128) |
直欄的 SQL 類型 |
| LENGTH |
INTEGER |
直欄的 SQL 類型的長度 |
| SCALE |
SMALLINT |
直欄的 SQL 類型的比例 |
| TYPE |
VARCHAR(64) |
直欄的類型,亦即 'nom' 或 'cont' |
| ROLE |
VARCHAR(64) |
直欄的角色,亦即 'id'、'target' 或 'input' |
| CARDINALITY |
BIGINT |
輸入直欄的相異值數目 |
| MINIMUM |
DOUBLE |
連續輸入直欄的最小值 |
| MAXIMUM |
DOUBLE |
連續輸入直欄的最大值 |
| MEAN |
DOUBLE |
連續輸入直欄的平均值 |
| VARIANCE |
DOUBLE |
連續輸入直欄的變異數 |
| NUMVALID |
BIGINT |
輸入直欄的有效值數目 |
| NUMINVALID |
BIGINT |
輸入直欄的無效值數目 |
| NUMMISSING |
BIGINT |
輸入直欄的空值數目 |
針對線性迴歸的傳回資訊
結果集視建立模型的指定選項而定。
- 如果建立模型時 calculatediagnostics 參數是設為 false,則會傳回一個結果集。
- 如果建立模型時 calculatediagnostics 參數是設為 true,則會傳回兩個結果集。第二個結果集包含其他診斷資訊。
表 2. 結果集 1 的結果集直欄
| 直欄名稱 |
直欄類型 |
說明 |
| PREDICTOR |
VARCHAR 取決於預測值名稱實際長度的可變長度
|
預測值的名稱,亦即,建立模型時指定為作用中輸入直欄的直欄 名義直欄可以包含相同預測值的數個項目。
如果建置模型時 intercept 選項是設定為 true,則結果集會包含一個額外的預測值 '(Intercept)'。此預測值表示在模型的建置程序期間包括的截距。
|
| PREDICTOR_LEVEL |
VARCHAR 取決於預測值層次名稱實際長度的可變長度
|
若為名義直欄,則為預測值層次的名稱,亦即,建立其模型的輸入表格中的直欄值 如果預測值是
'(Intercept)' 或者是連續資料類型,則此直欄刻意保留空白。
|
| COEFFICIENT |
DOUBLE |
模型建立期間判定的預測值係數 |
| STANDARD_DEVIATION |
DOUBLE |
預測值係數的標準差 如果針對模型建立將 calculatediagnostics 參數設為 false,則此值為 -1。
|
表 3. 包含其他診斷資訊之結果集 2 的結果集直欄
| 直欄名稱 |
直欄類型 |
說明 |
| INDICATOR |
VARCHAR() |
包含下列固定值:
- [Y_VAR_EST]
- 誤差項的變異數的預估值。
- [RSS]
- 模型的殘差平方和。
- [R²]
- R 平方(模型的判定係數)。
|
| VALUE |
DOUBLE |
指標值 |
PCA 模型的其他參數
- mode
- 選用。
- 決定要列印的模型資訊的模式。
- 容許的值為 standard 及 summary。
- 預設值:standard
針對 PCA 的傳回資訊
結果集視建立模型的指定選項而定。
若為 mode=standard,則輸出如下所示:
表 4. 結果集 1 -主成分的標準差向量
| 直欄名稱 |
直欄類型 |
說明 |
| ID |
VARCHAR(3) |
列索引,一律為‘[1] |
| PC<X> |
DOUBLE |
主成分 <X> 的標準差,其中 X 是 1 <= n 的數字 |
表 5. 結果集 2 – 變數負載的矩陣
| 直欄名稱 |
直欄類型 |
說明 |
| ID |
VARCHAR 取決於輸入變數名稱的可變長度
|
輸入變數的名稱 |
| PC<X> |
DOUBLE |
主成分 <X> 的特徵向量值,其中 X 是 1 <= n 的數字 |
若為 mode=summary,則輸出如下所示:
表 6. 結果集 1 - 主成分的主要統計資料
| 直欄名稱 |
直欄類型 |
說明 |
| MEASURE |
VARCHAR(27) |
僅包含固定值標準差、變異數比例及累積比例 |
| PC<X> |
DOUBLE |
主成分 <X> 的指標值,其中 X 是 1 <= n 的數字 |
序列型樣的其他參數
- outtable
- 選用。
- 在其中寫入型樣和規則的模型表格名稱。
- 預設值:none
- 資料類型:VARCHAR(128)
- 如果未指定任何值,則只會列印型樣或規則。
- type
- 選用。
- 要顯示的資訊類型。
- 預設值:"rules"
- 可能值為 "patterns" 和 "rules"。
- 資料類型:VARCHAR(8)
- limit
- 選用。
- 顯示的型樣或規則之數目上限。
- 預設值:none
- 範圍:>=1
- 資料類型:INTEGER
- 如果未指定任何值,則會顯示所有規則或型樣。
- itemsin
- 選用。
- 必須包含在所顯示的型樣或規則中的項目名稱清單。項目以分號區隔。至少必須包含其中一個列出的項目。
- 預設值:none
- 資料類型:VARCHAR(32000)
- 如果指定了 type=rules 參數,則下列條件適用:
- 若要指出該項目必須包含在規則標頭中,則項目名稱後面可以加上 :h 或 :head。
- 若要指出該項目必須包含在規則主體中,則項目名稱後面可以加上 :b 或 :body。
- 如果未指定此參數,則不會套用任何限制。
- itemsout
- 選用。
- 不得包含在所顯示的型樣或規則中的項目名稱清單。項目以分號區隔。
- 預設值:none
- 資料類型:VARCHAR(32000)
- 如果未指定此參數,則不會套用任何限制。
- minlen
- 選用。
- 要顯示的每個型樣或規則的最小項目數。
- 預設值:1
- 範圍:>= 1 且 <= maxlen
- 資料類型:INTEGER
- maxlen
- 選用。
- 要顯示的每個型樣或規則的最大項目數。
- 預設值:模型的最長序列型樣
- 範圍:>= minlen
- 資料類型:INTEGER
- minsupport
- 選用。
- 要顯示的型樣或規則的最小支持度。
- 預設值:0.0
- 範圍:>=0.0 且 <=maxsupport
- 資料類型:DOUBLE
- maxsupport
- 選用。
- 要顯示的型樣或規則的最大支持度。
- 預設值:1.0
- 範圍:>=minsupport 且 <=1.0
- 資料類型:DOUBLE
- minlift
- 選用。
- 要顯示的型樣或規則的最小提升度。
- 預設值:0.0
- 範圍:>=0.0 且 <=maxlift
- 資料類型:DOUBLE
- maxlift
- 選用。
- 要顯示的型樣或規則的最大提升度。
- 預設值:模型序列型樣的最大提升度
- 範圍:>=minlift
- 資料類型:DOUBLE
- minconf
- 選用。
- 要顯示的規則的最小信賴度。
- 預設值:0.0
- 資料類型:DOUBLE
- 範圍:>=0.0 且 <= maxconf
- 唯有指定了 type=rules 參數,您才能指定此參數。
- maxconf
- 選用。
- 要顯示的規則的最大信賴度。
- 預設值:1.0
- 資料類型:DOUBLE
- 範圍:>=minconf 且 <= 1.0
- 唯有指定了 type=rules 參數,您才能指定此參數。
- mintime
- 選用。
- 要顯示之規則的主體與標頭之間的最短時間。
- 如果在其中建置模型的資料序列的交易 ID 是日期、時間或時間戳記類型,則此參數的值是秒數。
- 預設值:0.0
- 資料類型:DOUBLE
- 範圍:>0.0 且 <= maxtime
- 唯有指定了 type=rules 參數,您才能指定此參數。
- maxtime
- 選用。
- 所顯示之規則的主體與標頭之間的時間上限。
- 如果在其中建置模型的資料序列的交易 ID 是日期、時間或時間戳記類型,則此參數的值是秒數。
- 預設值:模型規則的最長相對時間
- 資料類型:DOUBLE
- 範圍:>=mintime
- 唯有指定了 type=rules 參數,您才能指定此參數。
- sort
- 選用。
- 指出規則或型樣顯示順序的關鍵字清單。清單的順序是遞減。項目以分號區隔。
- 可能值為 "support"、"confidence"、"lift"、"length" 及 "time"。
- 如果指定了 type=rules 參數,則為預設值:
support;confidence;length
- 如果指定了 type=patterns 參數,則為預設值:
support;lift;length
- 資料類型:VARCHAR(32000)
針對序列型樣的傳回資訊
結果集包含所有型樣或規則,它們依 sort 參數中指定之順序符合所定義的限制項。如果指定 outtable 參數,則會建立與文字呈現具有相同內容的輸出表格。