按相似性自动把数据分成若干组的无监督方法。
食堂下课高峰抢座,不用贴标签,情侣会挨情侣,社牛会拼社牛,大家自己就坐成几拨。
它用于用户分群、异常发现和图像整理,先把乱数据分出圈层。
Unsupervised Learning
聚类是不依赖标签的典型无监督学习任务。
Classification
分类按已知标签判断,聚类则先自己分组。
Gaussian Mixture Model
GMM 是一种常见的概率式聚类实现方法。
Dimensionality Reduction
降维常先把数据摊开,方便聚类和观察结构。