IDAX.SPLIT_DATA - 將資料分割成訓練資料及測試資料

您可以使用此儲存程序,將輸入資料隨機分割成兩個分隔的子集:訓練資料集及測試資料集。然後,您可以使用建立的輸出表格來建置分類模型或迴歸模型,並測試其預測品質。

授權

陳述式的授權 ID 所持有的專用權必須包括 IDAX_USER 角色。

語法

IDAX.SPLIT_DATA(in parameter_string varchar(32672))

參數說明

parameter_string
必要的單一字串參數,其中包含以逗點區隔的 <parameter>=<value> 項目配對。
資料類型:VARCHAR(32672)
下列清單顯示參數值:
intable
必要。
輸入表格的名稱。
資料類型:VARCHAR(256)
traintable
必要。
包含輸入記錄的片段的輸出表格。
資料類型:VARCHAR(256)
testtable
必要。
輸出表格,其中包含輸入記錄的剩餘部分 (1-<fraction>)。
資料類型:VARCHAR(256)
id
必要。
輸入表格中用來識別唯一實例 ID 的直欄。
資料類型:VARCHAR(128)
fraction
選用。
要分割的資料片段。
最小值:0
最大值:1.0
預設值:0.5
資料類型:FLOAT
seed
選用。
隨機函數的種子。
預設值:random()
資料類型:FLOAT

傳回的資訊

FLOAT traintable 輸出表格中的記錄數。

範例

CALL IDAX.SPLIT_DATA('intable=CENSUSINCOME, id=ID, traintable=CENSUSINCOME_TRAIN, testtable=CENSUSINCOME_TEST, fraction=0.6, seed=1');