论文信息

论文标题：Graph-MLP: Node Classification without Message Passing in Graph
论文作者：Yang Hu, Haoxuan You, Zhecan Wang, Zhicheng Wang,Erjin Zhou, Yue Gao
论文来源：2021, ArXiv
论文地址：download
论文代码：download

1 介绍

　　本文工作：

　　　　不使用基于消息传递模块的GNNs，取而代之的是使用Graph-MLP：一个仅在计算损失时考虑结构信息的MLP。

　　任务：节点分类。在这个任务中，将由标记和未标记节点组成的图输入到一个模型中，输出是未标记节点的预测。

2 方法

2.1 GNN 框架

　　普通的 GNN 框架：

　　　　$\mathbf{X}^{(l+1)}=\sigma\left(\widehat{A} \mathbf{X}^{(l)} W^{(l)}\right)\quad\quad\quad(1)$　　

　　　　$\widehat{A}=\mathbf{D}^{-\frac{1}{2}}(A+I) \mathbf{D}^{-\frac{1}{2}}\quad\quad\quad(2)$

2.2 Graph-MLP

　　整体框架如下：

2.2.1 MLP-based Structure

　　结构： linear-activation-layer normalization-dropout-linear-linear

　　即：

　　　　$\begin{array}{c} \mathbf{X}^{(1)}=\text { Dropout }\left(L N\left(\sigma\left(\mathbf{X} W^{0}\right)\right)\right) \quad\quad\quad(3)\\ \mathbf{Z}=\mathbf{X}^{(1)} W^{1} \quad\quad\quad(4)\\ \mathbf{Y}=\mathbf{Z} W^{2}\quad\quad\quad(5) \end{array}$

　　其中：$Z$ 用于 NConterast 损失，$ Y$ 用于分类损失。

2.2.2 Neighbouring Contrastive Loss

　　在 NContast 损失中，每个节点的 $\text{r-hop}$ 邻居为正样本，其他节点为负样本。这种损失鼓励正样本更接近目标节点，并根据特征距离推动负样本远离目标节点。采样 $B$ 个邻居，第 $i$ 个节点的 NContrast loss 可以表述为：

　　　　${\large \ell_{i}=-\log \frac{\sum\limits _{j=1}^{B} \mathbf{1}_{[j \neq i]} \gamma_{i j} \exp \left(\operatorname{sim}\left(\boldsymbol{z}_{i}, \boldsymbol{z}_{j}\right) / \tau\right)}{\sum\limits _{k=1}^{B} \mathbf{1}_{[k \neq i]} \exp \left(\operatorname{sim}\left(\boldsymbol{z}_{i}, \boldsymbol{z}_{k}\right) / \tau\right)}} \quad\quad\quad(6)$

　　其中：$\gamma_{i j} $ 表示节点 $i$ 和节点 $j$ 之间的连接强度，这里定义为 $\gamma_{i j}=\widehat{A}_{i j}^{r}$。

　　$\gamma_{i j}$ 为非 $0$ 值当且仅当结点 $j$ 是结点 $i$ 的 $r$ 跳邻居，即：

　　　　$\gamma_{i j}\left\{\begin{array}{ll}=0, & \text { node } j \text { is the } r \text {-hop neighbor of node } i \\\neq 0, & \text { node } j \text { is not the } r \text {-hop neighbor of node } i \end{array}\right.$

　　而分类损失采用的是传统的交叉熵（用 $loss_{NC}$ 表示 )，因此综上所述Graph-MLP的总损失函数如下：

　　　　$\begin{aligned}\operatorname{loss}_{N C} &=\alpha \frac{1}{B} \sum\limits _{i=1}^{B} \ell_{i}\quad\quad\quad(7)\\\text { loss }_{\text {final }} &=\operatorname{loss}_{C E}+\operatorname{loss}_{N C}\quad\quad\quad(8) \end{aligned}$

2.2.3 Training

　　整个模型以端到端的方式进行训练。我们的模型不需要使用邻接矩阵，在计算训练期间的损失时只参考图结构信息。

　　在每个 $batch$ 中，我们随机抽取 $B$ 个节点并取相应的邻接信息 $\widehat{A} \in \mathbb{R}^{B \times B}$，和节点特征 $\mathbf{X} \in R^{\mathbb{R} \times d}$。对于某些节点 $i$，由于 $batch$ 抽样的随机性，可能会发生 $batch$ 中没有 positive samples。在这种情况下，将删除节点 $i$ 的损失。我们发现我们的模型对 positive samples 和 negative samples 的比例是稳健的，而没有特别调整的比例。

　　我们的算法如 Algorithm 1 所示：

2.2.4 Inference

　　在推断过程中，传统的图模型如 GNN 同时需要邻接矩阵和节点特征作为输入。不同的是，我们基于MLP的方法只需要节点特征作为输入。因此，当邻接信息被损坏或丢失时，Graph-MLP仍然可以提供一致可靠的结果。在传统的图建模中，图信息被嵌入到输入的邻接矩阵中。对于这些模型，图节点转换的学习严重依赖于内部消息传递，而内部消息传递对每个邻接矩阵输入中的连接都很敏感。然而，我们对图形结构的监督是应用于损失水平的。因此，我们的框架能够在节点特征转换过程中学习一个图结构的分布，而不需要进行前馈消息传递。这使得我们的模型在推理过程中对特定连接的敏感性较低。

3 实验

3.1 数据集

3.2 对引文网络节点分类数据集的性能

3.3 Graph-MLP 与 GNN 的效率

3.4 关于超参数的消融术研究

3.5 嵌入的可视化

3.6 鲁棒性

　　为了证明Graph-MLP在缺失连接下进行推断仍具有良好的鲁棒性，作者在测试过程中的邻接矩阵中添加了噪声，缺失连接的邻接矩阵的计算公式如下：

　　　　$A_{\text {corr }}=A \otimes mask +(1- mask ) \otimes \mathbb{N} \quad\quad\quad(9)$

　　　　$\operatorname{mask}\left\{\begin{array}{ll} =1, & p=1-\delta \\ =0, & p=\delta \end{array}\right.\quad\quad\quad(10)$

　　其中 $\delta$ 表示缺失率，$mask \in n \times n$ 决定邻接矩阵中缺失的位置，$mask$ 中的元素取 $1 / 0$ 的概率为 $1-\delta / \delta$ 。 $\mathbb{N} \in n \times n$ 中的元素取 $1 / 0$ 的概率都为 $0.5$ 。

　　结论：从上图可以看出随着缺失率的增加，GCN的推断性能急剧下降，而Graph-MLP却基本不受影响。

论文解读（Graph-MLP）《Graph-MLP: Node Classification without Message Passing in Graph》的更多相关文章

论文解读(GraphSMOTE)《GraphSMOTE: Imbalanced Node Classification on Graphs with Graph Neural Networks》
论文信息论文标题:GraphSMOTE: Imbalanced Node Classification on Graphs with Graph Neural Networks论文作者:Tianxi ...
论文解读（DropEdge）《DropEdge: Towards Deep Graph Convolutional Networks on Node Classification》
论文信息论文标题:DropEdge: Towards Deep Graph Convolutional Networks on Node Classification论文作者:Yu Rong, We ...
论文解读（MERIT）《Multi-Scale Contrastive Siamese Networks for Self-Supervised Graph Representation Learning》
论文信息论文标题:Multi-Scale Contrastive Siamese Networks for Self-Supervised Graph Representation Learning ...
论文解读（ N2N）《Node Representation Learning in Graph via Node-to-Neighbourhood Mutual Information Maximization》
论文信息论文标题:Node Representation Learning in Graph via Node-to-Neighbourhood Mutual Information Maximiz ...
论文解读（soft-mask GNN）《Soft-mask: Adaptive Substructure Extractions for Graph Neural Networks》
论文信息论文标题:Soft-mask: Adaptive Substructure Extractions for Graph Neural Networks论文作者:Mingqi Yang, Ya ...
论文解读（Graphormer）《Do Transformers Really Perform Bad for Graph Representation?》
论文信息论文标题:Do Transformers Really Perform Bad for Graph Representation?论文作者:Chengxuan Ying, Tianle Ca ...
论文解读（SEP）《Structural Entropy Guided Graph Hierarchical Pooling》
论文信息论文标题:Structural Entropy Guided Graph Hierarchical Pooling论文作者:Junran Wu, Xueyuan Chen, Ke Xu, S ...
论文解读（GCC）《Efficient Graph Convolution for Joint Node RepresentationLearning and Clustering》
论文信息论文标题:Efficient Graph Convolution for Joint Node RepresentationLearning and Clustering论文作者:Chaki ...
论文解读（GraphMAE）《GraphMAE: Self-Supervised Masked Graph Autoencoders》
论文信息论文标题:GraphMAE: Self-Supervised Masked Graph Autoencoders论文作者:Zhenyu Hou, Xiao Liu, Yukuo Cen, Y ...

随机推荐

微信小程序清除缓冲
1:wxml定义一个清除缓冲的按钮,并绑定触摸事件 <button bindtap="clear">清空缓冲</button> 2:wxjs定义方法: // ...
什么是phpize及其用法
应用场景在使用php的过程中,我们常常需要去添加一些PHP扩展库.但是重新对php进行编译是比较蛮烦的,所以这时候我们可以使用phpize对php进行添加扩展.并且phpize编译的扩展库可以随时启用 ...
C/C++读取SEGY文件（三）
SEGY IO (IBM&PC) 本文档将介绍SEGY的读取与写入过程,其中包括IBM与PC两种数据格式的转换. 程序将调用IEEE2IBM.cpp文件完成IBM与PC格式的互相转换. 新建头 ...
async-validator 源码学习（一）：文档翻译
async-validator 是一个表单异步校验库,阿里旗下的 Ant-design 和 Element 组件库中的表单验证使用的都是 async-validator ,目前版本已更新到 4.0.7 ...
LGP6144题解
冲了50分钟外加10分钟厕所才冲出来,请问我还有救吗. 看上去像是金组题目的加强版,实际上是金组题目的魔改版. 还是考虑像弱化版那样按照左端点排序,并且记录答案的 $0\sim k$ 次幂和. 然 ...
.NET Core剪裁器Zack.DotNetTrimmer升级瘦身引擎，并支持剪裁计划的录制和回放
上周,我发布了对.NET Core程序进行瘦身的开源软件Zack.DotNetTrimmer,与.NET Core内置的剪裁器相比,Zack.DotNetTrimmer不仅对程序的剪裁效果更好,而且还 ...
在 Ubuntu 上使用源码安装 OpenResty
镜像下载.域名解析.时间同步请点击阿里云开源镜像站本文将介绍如何在 Ubuntu 上使用源码安装 OpenResty. 目标 Ubuntu 18.04 OpenResty 1.19.3.2 安装依 ...
使用Xtrabackup 备份mysql数据库
##创建逻辑卷 [root@node1 ~]# pvcreate /dev/sdb1 Physical volume "/dev/sdb1" successfully create ...
pip国内镜像，提升下载速度和安装成功率
对于Python开发用户来讲,PIP安装软件包是家常便饭.但国外的源下载速度实在太慢,浪费时间.而且经常出现下载后安装出错问题.所以把PIP安装源替换成国内镜像,可以大幅提升下载速度,还可以提高安装成 ...
数据库原理之MySQL
数据库种类: 关系型数据库: mysql 专注于数据安全和功能 ,存取时会有表的结构化操作解析sql语句---- 丢给磁盘存取 ----取出,结构化成表常用关系型数据库产品介绍oracle数据库 ...

论文解读（Graph-MLP）《Graph-MLP: Node Classification without Message Passing in Graph》