机器学习算法之k-means

本文深入探讨了由J.B.MacQueen于1967年提出的K-means算法,这是一种广泛应用的无监督学习方法,尤其适用于大规模数据的聚类分析。文章详细介绍了算法的工作原理,包括如何初始化聚类中心,通过计算距离来分配样本,以及更新聚类中心的过程,直至达到收敛条件。

K-means算法在1967年由J.B.MacQueen提出,是一种基于划分的动态聚类算法,同时也是一种具有较大影响力的无监督学习算法。该算法的优点是思想简单易行,时间复杂性接近线性,对大规模数据的挖掘具有高效性和可伸缩性,在工况分类等领域中有着广泛的应用。
K-means算法的基本思想是:对一个包含样本数据的样本集进行分类,确定聚类数目K值后,随机选取K个样本作为初始聚类中心,根据相似性度量函数分别计算其它样本到K个聚类中心的距离,并将该未分类样本划分到与之最近的那个聚类中心所在的类中。对每个样本完成分类后,计算每一个类中所有样本数据的平均值作为新的聚类中心,重新划分聚类,直到聚类中心不再改变或者误差小于一定范围时,迭代结束。该算法在每一次迭代过程中,都需将每一个样本重新划分到新的类中。

Created with Raphaël 2.2.0开始计算样本到K个聚类中心的距离聚类中心是否收敛?结束yesno
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值