titc.ai › BLOG

BLOG · AI入門・機械学習

k-means(クラスタリング)の動きをアニメーションで理解する

「似たもの同士を自動でグループ分け」の仕組みを、動かして確かめる

公開日 / 著者 富田 良治(TITC合同会社 代表社員)

k-means(ケーミーンズ)法は、似たもの同士をK個のグループに自動で分ける手法です。たとえば「お客様を購買の傾向で分ける」「店舗を売上のパターンで分ける」といった場面で使われます。下のデモで、グループ分けが少しずつ整っていく様子を見てみましょう。

動かして確かめる

点の一つひとつが、お客様(または店舗)だと思ってください。横軸・縦軸は、たとえば「買い物の頻度」と「1回あたりの金額」です。まずは「再生」を押してください。

反復回数:0 回
「再生」か「1ステップ進む」を押してください。
まとまりの悪さ(点と中心の距離の二乗和):-

まとまりの悪さの推移(下がるほど、グループが整っています)

四角い印が各グループの「中心」です。画面をクリック(タップ)すると点を追加できます。

何が起きているのか:2つの作業の繰り返し

k-meansがやっているのは、次の2つを交互に繰り返すことだけです。

  1. 割り当て:それぞれの点を、いちばん近い「中心」のグループに入れる。(デモで点の色が変わるところ)
  2. 更新:各グループの中心を、そのグループの点の「平均の位置」へ動かす。(デモで四角い印が滑るように動くところ)

中心が動くと、「いちばん近い中心」が変わる点が出てきます。そこでまた割り当て直し、また中心を動かし……と続けます。やがて誰もグループを変えなくなったら終わりです。これを「収束」と呼びます。グラフの「まとまりの悪さ」が、毎回同じか小さくなっていくのも確かめてみてください。

最初の中心は「とりあえずの当て推量」でかまいません。繰り返すうちに、中心がデータの塊の真ん中に落ち着いていくのが、この手法の面白いところです。

使うときの注意点

中小企業での使いどころ

顧客名簿や売上データがあれば、「よく来る少額の常連」「たまに来て高額を買う層」のように、人が気づいていなかったグループを見つけるきっかけになります。グループごとに案内の文面や販促を変えるなど、打ち手の検討にもつながります。分けた結果に名前を付けて意味を考えるのは、現場を知る人の仕事です。

ご相談

自社のデータで顧客分析を試したい、AIで業務を自走化したい——そうした相談は、AIエージェント自走化プログラムまたはお問い合わせからどうぞ。

AIエージェント自走化プログラム お問い合わせ

富田 良治

富田 良治(とみた よしはる)

TITC合同会社 代表社員

AI経営コンサルタント。中小企業診断士・ITストラテジスト。元ITエンジニアで駄菓子屋オーナー。 プロフィールを見る