用於 K-means 叢集作業的函數

K-means 演算法是實作在 KMEANS 儲存程序及 PREDICT_KMEANS 儲存程序中。若要列印 K-means 模型,請使用 PRINT_MODEL 程序。

KMEANS 儲存程序及 PREDICT_KMEANS 儲存程序具有下列功能:

  • 支援連續屬性及離散屬性,以進行下列計算和呈現:
    差異型計算
    如果值相等,則假設離散值之間的差異為 0。如果值不相等,則會假設差異為 1。
    叢集中心表示法
    模式用於離散屬性,而非平均值。模式是最常出現的值。
  • 距離函數 Normalized Euclidean ("distance=norm_euclidean") 和 Euclidean ("distance=euclidean")

    Euclidean 是預設值。

  • 根據聚合或在指定的反覆運算次數上限之後的停止準則
  • 新資料的叢集成員資格預測
註: 包含空值之輸入表格的列會被忽略。

所有儲存程序皆包含必要的單一字串參數,其包含 <parameter>=<value> 項目的配對。這些項目以逗點區隔。參數的資料類型為 VARCHAR(any)。

在每一個儲存程序的參數說明中,會列出有效的 <parameter>=<value> 項目。