1 聚类算法的概念
- 一种典型的无监督学习算法,
- 主要用于将相似的样本自动归到一个类别中
- 计算样本和样本之间的相似性,一般使用欧式距离
- 聚类算法分类
- 粗聚类
- 细聚类
2 聚类算法与分类算法最大的区别
- 聚类算法是无监督的学习算法,而分类算法属于监督的学习算法。
3 聚类算法在现实中的应用
-
用户画像,广告推荐,Data Segmentation,搜索引擎的流量推荐,恶意流量识别
-
基于位置信息的商业推送,新闻聚类,筛选排序
-
图像分割,降维,识别;离群点检测;信用卡异常消费;发掘相同功能的基因片段