K-means 叢集作業

K-means 演算法是最廣泛使用的叢集作業演算法,它使用明確的距離測量,將資料集分割為叢集。

K-means 演算法的主要概念,是以數值屬性所有訓練實例的平均值屬性值向量,以及以指派給叢集的名義屬性限制模式(最常用)值的向量,來代表每一個叢集。此叢集表示法稱為叢集中心

叢集中心適用下列條件:

  • 演算法處理連續屬性及名義屬性。
  • 您可以套用距離函數,以比對叢集中心的實例,以有效率的計算方式來處理叢集構成和叢集建模的程序。