热门算法总结 —— AP聚类

AP(affinity propagation)聚类算法 AP(affinity propagation)聚类算法 引言 AP(affinity propagation)聚类算法是用来解决什么问题的 AP(affinity propagation)聚类算法具体是怎么实现的 AP(affinity propagation)聚类算法在我们算法中的应用 AP(affinity propagation)聚类算法的改进 AP(affinity propagation)聚类算法是用来解决什么问题的 AP(affinity propagation)聚类算法具体是怎么实现的 阅读详情

1、算法简介

(1)概述:AP聚类是在2007年的《Clustering by Passing Messages Between Data Points》一文中首次提出的一种新的聚类算法。该算法无需事先定义类数,而是在迭代过程中不断搜索合适的聚类中心,自动从数据点间识别类中心的位置及个数,使所有的数据点到最近的类代表点的相似度之和最大。算法开始时把所有的数据点均视作类中心,通过数据点间的“信息传递”来实现聚类过程。与传统的K-均值算法对初始类中心选择的敏感性相比,AP算法是一种确定性的聚类算法,多次独立运行的聚类结果一般都十分稳定。AP算法是在数据点的相似度矩阵上进行聚类的,聚类的目标是使数据点与其类代表点之间的距离达到最小化。

(2)主要用途:聚类分析。

(3)优缺点

[1] 优点:第一,与众多聚类算法不同,AP聚类不需要指定K(经典的K-Means)或者是其他描述聚类个数(SOM中的网络结构和规模)的参数;第二,一个聚类中最具代表性的点在AP算法中叫做E(Examplar),与其他算法中的聚类中心不同,E是原始数据中确切存在的一个数据点,而不是由多个数据点求平均而得到的聚类中心(K-Means);第三,多次执行AP聚类算法,得到的结果是完全一样的,即不需要进行随机选取初值步骤;第四,对距离矩阵的对称性没要求。AP通过输入相似度矩阵来启动算法,因此允许数据呈非对称,数据适用范围非常大,且误差平方和低。

[2] 缺点:第一,算法复杂度较高,比而K-Means的复杂度高很多。因此当n比较大时(n>3000),AP聚类算法往往需要算很久;第二,依赖参考度P的初值。

2、算法流程

3、模拟例子

(1)说明

[1] 数据情况:小明班上30名同学的成绩数据。

[2] 研究目的:将小明班上的同学进行聚类。

(2)分析步骤

[1] 第一步:输入小明班上30名同学的成绩;

[2] 第二步:使用AP聚类对小明班上30名同学的成绩进行聚类分析;

[3] 第三步:输出聚类结果。

(3)结果模拟:模型自动将小明班上30名同学分为了3类,经过数据研究,将第1类命名为学霸组(共6名学生),第2类命名为普通学生组(共17名同学),第3类命名为学渣组(共7名同学)。

 

——————————————————★

互联网数据分析岗位求职备战手册

AP近邻传播聚类算法总结 AP(Affinity Propagation)算法是Fery等在2007提出的一种基于近邻传播的半监督聚类算法算法的基本思想是:首先通过消息传递机制来搜索网络中各个数据点的聚类中心以及数据点与数据中心之间的隶属关系,然后根据数据中心和顶点之间的隶属关系来对待聚类数据集进行划分,形成若干个具有特定意义的子集。该算法的优点众多,比如算法聚类的过程中不需要明确确定与聚类个数相关的参数;聚类中心是待聚 阅读详情

相关推荐

一文搞懂K-means聚类AP聚类

一文搞懂K-means聚类AP聚类 文章目录一文搞懂K-means聚类AP聚类1. K-means聚类1.1 背景及发展介绍1.2 算法及公式介绍1.3 案例介绍2. Affinity Propagation (AP)聚类2.1 背景及发展介绍2.2 算法及公式介绍2.3 案例介绍3. 参考文献 1. K-means聚类 1.1 背景及发展介绍 K−meansK-meansK−means算法的...

weixin_44720323的博客 3218

聚类算法AP(Affinity Propagation)聚类算法(近邻传播)

定义 在统计和数据挖掘中,近邻传播(AP)是基于数据点之间的“消息传递”概念的聚类算法。与聚类算法如ķ-means或ķ-medoids,近邻传播不需要簇的数目来确定或运行算法之前估计。类似于k-medoids,近邻传播找到“范例”,输入集的成员代表集群。 基本思想 AP算法的基本思想是将全部样本看做网络的节点,然后通过网络中各条边的消息传递计算出个样本的聚类中心。聚类过程中,共有两种消...

jack_jay_du的博客 3629

K-Means与Affinity Propagation聚类算法实战对比

聚类是无监督学习中最基础且高频的探索性数据分析技术,核心在于依据样本相似性自动发现数据内在分组结构。其原理依赖于距离度量或相似度建模,技术价值体现在无需标注即可支撑用户分群、异常检测、推荐冷启动等关键场景。K-Means以欧氏距离驱动、需预设簇数,适合大规模、球形分布数据;Affinity Propagation则通过消息传递自主涌现簇结构,擅长识别非球形、小样本、高语义精度的细分模式。二者在初始化敏感性、参数可解释性、计算复杂度及业务适配性上存在本质差异,实际选型需兼顾数据规模、特征形态与运营目标。

chulilang8944的博客 410

数据挖掘——AP聚类算法学习

文章目录一、算法简介二、算法模型1、相关概念(假如有数据点i和数据点j)2、数学公式三、算法流程_python代码四、sklearn中AP算法使用五、总结参考资料: 一、算法简介   AP(Affinity Propagation)通常被翻译为近邻传播算法或者亲和力传播算法。是2007年的Science杂志上提出的一种新的聚类算法AP算法的基本思想是将全部数据点都当作潜在的聚类中心(称为exem...

潘多拉星系的专栏 6252

数据挖掘实验二 :聚类技术—复杂网络社团检测

实验二 :聚类技术—复杂网络社团检测 实验内容 导入karate.gml中的空手道网络数据; 根据网络结构特征给出节点相似性度量指标; 采用层次聚类过程对网络数据进行聚类; 计算模块性指标Q值,当Q值最大时输出聚类结果; 采用Cytoscape工具,可视化聚类结果。 分析及设计 导入数据包: 用python的networks包中的read_ gml方法读取“图”的数据; 观察图的信息:34个顶点、78条边的无向图; 构建节点相似度矩阵: 无向图的节点相似度

OutlierLi's Blog 2280

机器学习试验.TravelRouteRecommendation搭建(可能弃坑)

目录 Paper翻译 I. INTRODUCTION II. BACKGROUND AND RELATED WORK III. PROPOSED SYSTEM IV. RESULTS AND ANALYSIS 尝试搭建 项目地址https://github.com/ashrithhc/TravelRouteRecommendation 之前找好久找不到,都绝望了。这回又找到相似的了...

越开源越幸运 975

目标检测算法超全解析:从传统方法到前沿技术

目标检测作为计算机视觉领域的核心任务,致力于识别图像或视频中的目标物体,并确定其位置。这一技术广泛应用于安防监控、自动驾驶、智能医疗等众多领域,是推动人工智能发展的关键力量。本文将全面梳理目标检测算法,涵盖传统方法与当下热门的深度学习算法,为你深入剖析其原理与应用。

COOCC1的博客 1480

无监督学习在图像处理中的进展

1.背景介绍 无监督学习是一种机器学习方法,它不需要人工标注的数据来训练模型。相反,它利用未标注的数据来发现数据中的模式和结构。在图像处理领域,无监督学习已经成为一个热门的研究领域,因为它可以帮助我们解决许多复杂的图像处理任务,如图像分类、对象检测、图像生成等。 无监督学习在图像处理中的主要优势包括: 不需要大量的人工标注数据,这在实际应用中非常重要,因为人工标注数据的收集和维护成本非常高...

AI天才研究院 618

推荐算法之协同过滤算法

协调过滤算法(CF) 上一篇文章中提到过,推荐系统中常用到的算法包括用户偏好算法、协同过滤算法(item_base,user_base)、关联规则算法聚类算法、内容相似性算法(content_base)。关联规则中的 Apriori 算法和 FP-growth 算法在之前的文章已经详细介绍过,在这篇文章中,将介绍协同过滤算法(基于用户的协同过滤算法、基于物品的协同过滤算法)。 一、算法核心 协同...

qq_42851418的博客 3707

纽约Uber数据分析图形化和K-means计算热点

K-means是一种聚类算法,用于将一组样本分成预定数量的簇。它通过计算样本之间的距离,将它们分配到最近的簇中,然后根据分配的结果,更新簇的中心位置。这个过程迭代进行,直到簇的中心位置不再变化或达到预定的迭代次数。K-means算法的目标是最小化簇内样本之间的方差,同时最大化簇与簇之间的距离,以达到有效的聚类效果。它是一种简单且高效的聚类算法,常用于数据挖掘、图像处理和模式识别等领域。

qq_74156152的博客 639

88、物联网与网络热点话题处理技术解析

本文探讨了物联网在空气污染防治中的应用及其面临的挑战,如安全、隐私和集成问题,并介绍了一种基于语义相似度和增量K-Means算法的智能模型,用于实时聚合与追踪网络热点话题。该模型通过多源数据整合、优化的语义计算和动态聚类,在实验中展现出优于传统方法的性能,具有广泛应用于新闻媒体、市场营销和政府决策的前景。未来将聚焦于语义深化、跨领域应用及安全隐私保护的进一步优化。

u9v0w的博客 55

19、基于MOEA的复杂网络社区检测算法解析

本文介绍了两种基于多目标进化算法(MOEA)的复杂网络社区检测方法:APMOEA和GMOEA-net。APMOEA结合亲和传播进行初步划分,并利用多目标进化算法优化模块化密度相关的目标函数,避免局部最优;GMOEA-net则基于节点相似性构建相似矩阵,采用预分割、交叉合并与变异算子进行高效搜索。两种算法均在计算机生成网络和真实世界网络上进行了实验验证,表现出良好的收敛性与划分质量,优于传统社区检测方法。

rnn9storyteller的博客 49

常见聚类算法及使用--Affinity Propagation(AP

对于聚类算法,大家应该都已经略知一二,比如说它是无监督,不需要标签来监督它的学习,我们需要的是在特定场景下将这些未被标注的数据进行自然分组。聚类是在输入数据的特征空间中查找自然组的无监督问题;对于所有数据集,有许多不同的聚类算法和单一的最佳方法;在机器学习库的Python中如何实现、适配和使用顶级聚类算法AP聚类算法与经典的K-Means聚类算法相比,具有很多独特之处:无需指定聚类“数量”参数。

june_young_fan的博客 4571

ap聚类是什么

更新“吸引度”矩阵:\(A(i,j) = \min(0, s(i,j) + \sum_{k} \max(0, S(i,k))\),其中 \(s(i,j)\) 是数据点 \(j\) 选择数据点 \(i\) 作为其代表时的相似度。- 更新“相似性”矩阵:\(S(i,j) = s(i,j) - a(i,j)\),其中 \(s(i,j)\) 是原始相似度,\(a(i,j)\) 是数据点 \(i\) 选择数据点 \(j\) 作为其代表时的吸引度。每个数据点既是候选的中心点,也是其他数据点的邻居点。

weixin_71158509的博客 1115

聚类算法 ap 聚类聚类

AP聚类是一种强大的聚类算法,特别适合中小规模数据集和不需要预先指定聚类数量的场景。然而,它的计算复杂度较高,不适合处理大规模数据。在实际应用中,可以根据数据特点选择合适的聚类算法。我来给你简单介绍一下 AP 聚类,也叫 Affinity Propagation 聚类(亲和传播聚类)。什么是 AP 聚类AP 聚类是一种不需要提前指定簇数量的聚类算法。和 KMeans 这种算法不同,它通过让数据点互相“发送消息”,自动决定哪些点是簇的中心(即“代表点”或“样本代表”),最后形成不同的簇。

Gsen2819的博客 1210

Python实现AP聚类算法完整指南:apcluster.py

聚类分析是数据挖掘和无监督学习中的一项基础而关键的技术,它旨在发现数据集中的内在分布和结构。随着数据科学的发展,对聚类算法的要求不断提高,传统的层次聚类、K均值聚类等方法逐渐显示出它们在处理大规模数据集时的局限性。在这种背景下,AP聚类算法应运而生,它以其独特的无中心聚类特性,成功地解决了部分传统聚类方法中无法处理的问题。本章将对AP算法做一个概括性的介绍,并详细探讨其背后的原理与步骤。在AP聚类算法中,责任(R)指的是一个数据点(点i)认为某个数据点(点j)属于其当前潜在簇的程度。

weixin_42561464的博客 1090

【论文笔记】AP聚类算法解读

简单介绍理解成本较高却异常好用的聚类算法

Xixoqw的博客 2529

机器学习:Python实现聚类算法(二)之AP算法

AP(Affinity Propagation)通常被翻译为近邻传播算法或者亲和力传播算法,是在2007年的Science杂志上提出的一种新的聚类算法AP算法的基本思想是将全部数据点都当作潜在的聚类中心(称之为exemplar),然后数据点两两之间连线构成一个网络(相似度矩阵),再通过网络中各条边的消息(responsibility和availability)传递计算出各样本的聚类中心。

AI333888的博客 1346
上一篇: 实际业务中的数据分析流程和痛点
下一篇: 聊一聊时间序列聚类
稀饭居然不在家
博客等级 码龄18年 4粉丝 20原创
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

稀饭居然不在家

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值