图卷积神经网络1-谱域图卷积:拉普拉斯变换到谱域图卷积

知乎主页

备注:本篇博客摘自某培训机构上的图神经网络讲解的视频内容,该视频关于图神经网络入门讲解、经典算法的引入和优缺点的介绍比较详细,逻辑主线也比较清晰。因此记录分享下。

目录:

  1. 图卷积近年发展
  2. 图卷积简介
    2.1. 经典卷积神经网络的应用
    2.2. 经典卷积神经网络的局限
    2.3. 如何将卷积操作拓展到图结构数据中?
  3. 谱域卷积
    3.1. 图谱卷积背景知识
    3.2. 图谱卷积的数学知识
    3.3. 图傅里叶变换
    3.4. 图傅里叶反变换
    3.5. 图傅里叶正变换
    3.6. 经典傅里叶变换与图傅里叶变换的对比
    3.7. 拉普拉斯特征向量和基本性质
  4. 总结回顾

逻辑主线整理:

  1. 由于经典卷积神经网络不能处理非结构化数据,因此考虑如何将卷积操作拓展到图结构数据中
  2. 实现思路:
    1:谱域图卷积
    2:空域图卷积
  3. 谱域卷积背景知识:
    1:卷积介绍:两信号在空域(或者时域)的卷积的傅立叶变换等于这两信号在频 域的傅立叶变换的乘积
    2:卷积意义:将空域信号转换到频域,然后相乘;将相乘的结果再转换到空域
    3:图上的傅立叶变换

1:图卷积近年发展

图神经网络在在2016年以前相关文献较少,但是到2018年,图神经网络发展迅速。到2019年,图网络的文章数量大幅增加!
历年图论文的链接:https://github.com/naganandy/graph-based-deep-learning-literature/tree/master/conference-publications
在这里插入图片描述
在这里插入图片描述

2:图卷积简介

2.1:经典卷积神经网络的应用

经典卷积神经网络已经在多个领域取得了成功,主要包括:图片分类、计算机视觉、图片分割、目标检测等领域。
在这里插入图片描述

2.2:经典卷积神经网络的局限

经典卷积神经网络局限:只适合处理结构化数据,无法处理图结构数据
在这里插入图片描述
其中语音可以看作是一维向量,图像可以看作是二维矩阵,视频可以看作是三维矩阵。
在这里插入图片描述
其中序列无序性是指:上图中红色节点的邻居节点有两个,而我们不知道它们谁应该排在前,谁应该排在后,这就是序列无序性。
维数可变性是指:上图中红色节点和蓝色节点的邻居节点个数是可以不相同的,这就是维数可变性。因此我们无法将3x3的卷积核应用到图数据上,这就是图卷积网络需要解决的问题。

2.3:如何将卷积操作拓展到图结构数据中?

实现思路1:谱域图卷积
谱域图卷积:

  • 根据图谱理论和卷积定了,将数据由空域转换到谱域做处理
  • 有较为坚实的理论基础

谱域图卷积也是本章重点


实现思路2:空域图卷积
空域图卷积:

  • 不依靠图谱卷积理论,直接在空间上定义卷积操作
  • 定义直观,灵活性强

图卷积经典模型回顾
在这里插入图片描述
在这里插入图片描述

本章重点介绍谱域图卷积方法,主要由上图圈出来的三篇文章讲解,即SCNN、GCN和ChebNet三个模型。

3:谱域卷积

3.1:图谱卷积背景知识

在这里插入图片描述
在这里插入图片描述
我们将 f 1 ( t ) f_{1}(t) f1(t) 定义为空域输入信号, f 2 ( t ) f_{2}(t) f2(t) 定义为空域卷积核,那么卷积核就可以这样定义: 首先将空域上的信号 f 1 ( t ) f_{1}(t) f1(t) 转换到频域信号 F 1 ( w ) , F_{1}(w), F1(w), 然后相乘, 再将相乘后的结果通过傅里叶反变换 后再返回空域上去, 这个就是谱域图卷积的实现思路(将空域转换到频域上处理, 处理完再返 回)

前面所说的经典的卷积操作具有序列有序性和维数不变性的限制,使得经典卷积难以处理图数据, 也就是说对于一个3x3的卷积核,它的形状是固定的,它的感受野的中心节点必须要有八个领域才能使用卷积核,但是图上的节点的领域节点是不确定的,此外图上节点的领域节点也是没有顺序的,这就导致不能直接在空域使用经典的卷积。但是把数据从空域转换到频域,在频域处理数据时,只需要将每个频域的分量放大或者缩小就可以了,不需要考虑信号在空域上存在的问题, 这个就是谱域图卷积的巧妙之处

如何定义图上的傅里叶变换?
在这里插入图片描述
接下来部分介绍谱域图卷积的数学背景知识,包括傅里叶变换。


3.2:图谱卷积的数学知识

在这里插入图片描述
其中 V V V代表所有节点的集合(共n个), E E E代表所有边的集合, W W W代表邻接矩阵(n x n的方阵), D D D为度矩阵,定义为从 i i i节点出发的所有边的权重之和(n x n的方阵,是对角矩阵)。下面看一个例子中,权重都为1。
在这里插入图片描述
在这里插入图片描述
上面是拉普拉斯矩阵半正定的展开证明,涉及到矩阵知识点,感兴趣的可以看看,个人觉得记住结论即可。


拉普拉斯矩阵的相关性质:
在这里插入图片描述


拉普拉斯矩阵的谱分解:
在这里插入图片描述
在这里插入图片描述
比如,在二维空间中有 u 1 u_{1} u1, u 2 u_{2} u2 两个线性无关的向量,则它们可以表示这个二维空间中的所有向量,它们就是二维空间中的一组基。
在这里插入图片描述
上面就是在说拉普拉斯矩阵特征分解后的特征向量不但是n维空间中的一组基,而且还是正交的(相乘为0),简称标准正交基。

但是为什么拉普拉斯矩阵是度矩阵减邻接矩阵,也就是 L = D − W L = D − W L=DW呢?原因是拉普拉斯矩阵是图上的一种拉普拉斯算子,接着看看拉普拉斯算子讲解与图上的拉普拉斯算子的证明(个人觉得也只需记住结论即可):
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
上面右图就是两个变量的离散拉普拉斯矩阵算子的解释,也就是说对于某个中心像素(红色)的算子为周围四个像素之和减去4倍的自己。
在这里插入图片描述


拉普拉斯矩阵与拉普拉斯算子:
在这里插入图片描述
对上面公式就是做一下简单的变换,只要是理解了前面讲的几个矩阵的定义,就很好理解了,对于n个节点则由变换后的公式得出(上面右边公式):

在这里插入图片描述


结论:
在这里插入图片描述


拉普拉斯矩阵性质总结:
在这里插入图片描述
以上就是拉普拉斯矩阵的性质,正是因为有了这些性质,才会使用拉普拉斯矩阵来图方面的工作。


3.3:图傅里叶变换

在这里插入图片描述
上图中蓝色线段代表信号的大小,类似于图像上灰度图像像素,像素越高,画的这个线段越长。图 上的信号也是类似的,只不过若一个信号有c个通道, 那么 x = [ x 1 , x 2 , … , x n ] ∈ R n ∗ c , x=\left[x_{1}, x_{2}, \ldots, x_{n}\right] \in R^{n * c}, x=[x1,x2,,xn]Rnc, 彩色图像 有R,G,B三个通道, 则 c = 3 c=3 c=3 。下面为了讲解简单, 先假设图上的一个信号只有一个通道,多个通道原理也是类似的。

在这里插入图片描述


傅里叶变换的物理意义:

评论 8
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值