GCN实践——可视化cora-network
本文主要介绍如何使用 GCN 可视化 cora 网络中节点
训练模型
按照源码上readme给出的步骤,训练 citation network —— cora 数据集。具体步骤如下:
- 步骤一:下载源代码。直接下载zip或者通过git下载都行;
- 步骤二:进入到 setup.py 所在的目录,执行命令
python setup.py install
- 步骤三:进入到 train.py 所在的目录,执行命令
python train.py
通过上面三步骤,利用gcn完成节点分类任务的模型就开始训练起来了!训练界面为:
Epoch: 0001 train_loss= 1.95399 train_acc= 0.07143 val_loss= 1.95070 val_acc= 0.20600 time= 0.08406
Epoch: 0002 train_loss= 1.94801 train_acc= 0.29286 val_loss= 1.94716 val_acc= 0.37000 time= 0.06582
Epoch: 0003 train_loss= 1.94218 train_acc= 0.48571 val_loss= 1.94333 val_acc= 0.47000 time= 0.06585
Epoch: 0004 train_loss= 1.93654 train_acc= 0.56429 val_loss= 1.93922 val_acc= 0.50400 time= 0.06383
Epoch: 0005 train_loss= 1.92665 train_acc= 0.66429 val_loss= 1.93517 val_acc= 0.50400 time= 0.06884
Epoch: 0006 train_loss= 1.92017 train_acc= 0.70000 val_loss= 1.93110 val_acc= 0.51400 time= 0.06865
Epoch: 0007 train_loss= 1.91050 train_acc= 0.71429 val_loss= 1.92704 val_acc= 0.52000 time= 0.06542
Epoch: 0008 train_loss= 1.89941 train_acc= 0.71429 val_loss= 1.92310 val_acc= 0.51600 time= 0.06480
Epoch: 0009 train_loss= 1.89015 train_acc= 0.75714 val_loss= 1.91920 val_acc= 0.52000 time= 0.07132
Epoch: 0010 train_loss= 1.88369 train_acc= 0.67143 val_loss= 1.91527 val_acc= 0.52000 time= 0.06580
....
....
Epoch: 0191 train_loss= 0.60898 train_acc= 0.98571 val_loss= 1.06063 val_acc= 0.78200 time= 0.06386
Epoch: 0192 train_loss= 0.63756 train_acc= 0.95714 val_loss= 1.05901 val_acc= 0.77800 time= 0.06482
Epoch: 0193 train_loss= 0.62371 train_acc= 0.94286 val_loss= 1.05767 val_acc= 0.77800 time= 0.06440
Epoch: 0194 train_loss= 0.60151 train_acc= 0.96429 val_loss= 1.05636 val_acc= 0.77800 time= 0.06582
Epoch: 0195 train_loss= 0.60843 train_acc= 0.95714 val_loss= 1.05533 val_acc= 0.77800 time= 0.06582
Epoch: 0196 train_loss= 0.59138 train_acc= 0.97143 val_loss= 1.05411 val_acc= 0.78000 time= 0.06286
Epoch: 0197 train_loss= 0.59821 train_acc= 0.97857 val_loss= 1.05297 val_acc= 0.78000 time= 0.06286
Epoch: 0198 train_loss= 0.60693 train_acc= 0.97143 val_loss= 1.05188 val_acc= 0.77800 time= 0.06479
Epoch: 0199 train_loss= 0.60899 train_acc= 0.95714 val_loss= 1.05047 val_acc= 0.77800 time= 0.06583
Epoch: 0200 train_loss= 0.59147 train_acc= 0.97143 val_loss= 1.04964 val_acc= 0.77800 time= 0.06485
Optimization Finished!
Test set results: cost= 1.01263 accuracy= 0.81400 time= 0.02793
可视化
进一步,利用 tsne 对 gcn 的 outputs 进行可视化,观测是否能分成明显的7簇?
需要注意的是,要修改源代码,以将网络中节点的embedding 和 label输出出来。
步骤一:修改 utils.py 的load_data()函数,将变量labels返回
return adj, features, y_train, y_val, y_test, train_mask, val_mask, test_mask, labels
步骤二:修改 train.py 文件。在训练完后添加代码
adj, features, y_train, y_val, y_test, train_mask, val_mask, test_mask, labels = load_data(FLAGS.dataset) ...... ..... print("Optimization Finished!") label_dict = {0:"0.0000000e+00",1:"1.0000000e+00",2:"2.0000000e+00",3:"3.0000000e+00",4:"4.0000000e+00",5:"5.0000000e+00",6:"6.0000000e+00"} # 定义标签颜色字典 # 写文件 with open("./embeddings.txt", "w") as fe, open("./labels.txt", 'w') as fl:for i in range(len(outs[3])):fl.write(label_dict[int(list(labels[i]).index(1.))]+"\n")fe.write(" ".join(map(str, outs[3][i]))+"\n")
可视化结果为
cora数据集可视化
可以发现GCN对cora数据集的可视化还是很友好的。即便使用的默认参数,也能训练出有意义的节点表示
GCN实践——可视化cora-network相关推荐
- 图卷积网络GCN(Graph Convolution Network)(一)研究背景和空域卷积
文章首发于个人站点: 图卷积网络GCN(Graph Convolution Network)(一)研究背景和空域图卷积 | 隐舍 公众号:[DreamHub] 由于文章篇幅较长,因此将其分解为三部分: ...
- 【pyg】第一篇总结(基于karate的3层GCN+简单可视化,额外补充了cora)
目录 Karate空手道俱乐部 数据集dataset统计查看 单张图graph数据data统计查看 可视化数据单张图数据
- [GCN] 增加可视化+代码注释 of GitHub项目:Graph Convolutional Networks in PyTorch
增加可视化+代码注释 of GitHub项目:Graph Convolutional Networks in PyTorch 更详细的,强烈推荐另一篇博客:[GCN] 代码解析 of GitHub:G ...
- 爱奇艺深度语义表示学习的探索与实践
导读:基于学术界和工业界经验,爱奇艺设计和探索出了一套适用于爱奇艺多种业务场景的深度语义表示学习框架.在推荐.搜索.直播等多个业务中的召回.排序.去重.多样性.语义匹配.聚类等场景上线,提高视频推荐的 ...
- Attention-Aware Compositional Network for Person Re-identification(行人识别组合网络+AACN)阅读笔记
对于这两天读的AACN这篇文章做个简单的笔记,自己尚且还存留着许多的困惑,希望在接下来的学习中能够掌握更多的部分,如果有时间我会回过头来再写一次. Person re-identification ( ...
- GCN的几种模型复现笔记
引言 本篇笔记紧接上文,主要是上一篇看写了快2w字,再去接入代码感觉有点不太妙,后台都崩了好几次,因为内存不足,那就正好将内容分开来,可以水两篇,另外也给脑子放个假,最近事情有点多,思绪都有些乱,跳出 ...
- 图卷积网络GCN简介
翻译自GRAPH CONVOLUTIONAL NETWORKS, THOMAS KIPF, 30 SEPTEMBER 2016,原文作者是semi-Supervised Classification ...
- matplotlib 均值_干货|教你一文掌握:Matplotlib+Seaborn可视化
转自:Python数据分析实战与AI干货 导语 Seaborn和Matplotlib是Python最强大的两个可视化库.Seaborn其默认主题让人惊讶,而Matplotlib可以通过其多个分类为用户 ...
- PYG教程【三】对Cora数据集进行半监督节点分类
Cora数据集 PyG包含有大量的基准数据集.初始化数据集非常简单,数据集初始化会自动下载原始数据文件,并且会将它们处理成Data格式. 如下图所示,Cora数据集中只有一个图,该图包含2708个节点 ...
- 论文阅读 [TPAMI-2022] Locally Connected Network for Monocular 3D Human Pose Estimation
论文阅读 [TPAMI-2022] Locally Connected Network for Monocular 3D Human Pose Estimation 论文搜索(studyai.com) ...
最新文章
- linux之reboot
- 《重新认识你自己》八:与真实的自我相处
- c# 无法加载oraops.dll_Robotstudio软件二次开发:基于C#语言的Smart组件开发基础
- 整合Hibernate3.x
- java反射--Class类
- git object 很大_这才是真正的Git——Git内部原理
- python中main的含义及用法_python中main函数的用法
- python基础教程自学网-Python基础系统管理学习手册视频教程
- 本人工作性质已改变,技术文摘随笔已经全部下线
- xp精简版安装iis
- 基本磁盘转换为动态磁盘后快速启动关机变重启,记录一次研究过程
- google 图片搜索API
- 计算机毕业设计(附源码)python疫情防控管理系统
- Neuronink是医学奇迹的噩梦
- Windows 自动连接wifi的bat批处理脚本
- win10雷电3接口驱动_[九猫win10系统]Intel处理器福利普及雷电3接口:微软/苹果强烈支...
- 石墨笔记,Ulysses,Effie,影评人该选什么样的文字编辑应用?
- Interval (mathematics)
- AUXR AUXR1
- 【网络安全常用术语解读】CWE详解