GCN实践——可视化cora-network
本文主要介绍如何使用 GCN 可视化 cora 网络中节点
训练模型
按照 源码上readme给出的步骤,训练 citation network —— cora 数据集。具体步骤如下:
- 步骤一:下载源代码。直接下载zip或者通过git下载都行;
- 步骤二:进入到 setup.py 所在的目录,执行命令
python setup.py install
- 步骤三:进入到 train.py 所在的目录,执行命令
python train.py
通过上面三步骤,利用gcn完成节点分类任务的模型就开始训练起来了!训练界面为:
Epoch: 0001 train_loss= 1.95399 train_acc= 0.07143 val_loss= 1.95070 val_acc= 0.20600 time= 0.08406
Epoch: 0002 train_loss= 1.94801 train_acc= 0.29286 val_loss= 1.94716 val_acc= 0.37000 time= 0.06582
Epoch: 0003 train_loss= 1.94218 train_acc= 0.48571 val_loss= 1.94333 val_acc= 0.47000 time= 0.06585
Epoch: 0004 train_loss= 1.93654 train_acc= 0.56429 val_loss= 1.93922 val_acc= 0.50400 time= 0.06383
Epoch: 0005 train_loss= 1.92665 train_acc= 0.66429 val_loss= 1.93517 val_acc= 0.50400 time= 0.06884
Epoch: 0006 train_loss= 1.92017 train_acc= 0.70000 val_loss= 1.93110 val_acc= 0.51400 time= 0.06865
Epoch: 0007 train_loss= 1.91050 train_acc= 0.71429 val_loss= 1.92704 val_acc= 0.52000 time= 0.06542
Epoch: 0008 train_loss= 1.89941 train_acc= 0.71429 val_loss= 1.92310 val_acc= 0.51600 time= 0.06480
Epoch: 0009 train_loss= 1.89015 train_acc= 0.75714 val_loss= 1.91920 val_acc= 0.52000 time= 0.07132
Epoch: 0010 train_loss= 1.88369 train_acc= 0.67143 val_loss= 1.91527 val_acc= 0.52000 time= 0.06580
....
....
Epoch: 0191 train_loss= 0.60898 train_acc= 0.98571 val_loss= 1.06063 val_acc= 0.78200 time= 0.06386
Epoch: 0192 train_loss= 0.63756 train_acc= 0.95714 val_loss= 1.05901 val_acc= 0.77800 time= 0.06482
Epoch: 0193 train_loss= 0.62371 train_acc= 0.94286 val_loss= 1.05767 val_acc= 0.77800 time= 0.06440
Epoch: 0194 train_loss= 0.60151 train_acc= 0.96429 val_loss= 1.05636 val_acc= 0.77800 time= 0.06582
Epoch: 0195 train_loss= 0.60843 train_acc= 0.95714 val_loss= 1.05533 val_acc= 0.77800 time= 0.06582
Epoch: 0196 train_loss= 0.59138 train_acc= 0.97143 val_loss= 1.05411 val_acc= 0.78000 time= 0.06286
Epoch: 0197 train_loss= 0.59821 train_acc= 0.97857 val_loss= 1.05297 val_acc= 0.78000 time= 0.06286
Epoch: 0198 train_loss= 0.60693 train_acc= 0.97143 val_loss= 1.05188 val_acc= 0.77800 time= 0.06479
Epoch: 0199 train_loss= 0.60899 train_acc= 0.95714 val_loss= 1.05047 val_acc= 0.77800 time= 0.06583
Epoch: 0200 train_loss= 0.59147 train_acc= 0.97143 val_loss= 1.04964 val_acc= 0.77800 time= 0.06485
Optimization Finished!
Test set results: cost= 1.01263 accuracy= 0.81400 time= 0.02793
可视化
进一步,利用 tsne 对 gcn 的 outputs 进行可视化,观测是否能分成明显的7簇?
需要注意的是,要修改源代码,以将网络中节点的embedding 和 label输出出来。
-
步骤一:修改 utils.py 的load_data()函数,将变量labels返回
return adj, features, y_train, y_val, y_test, train_mask, val_mask, test_mask, labels
-
步骤二:修改 train.py 文件。在训练完后添加代码
-
adj, features, y_train, y_val, y_test, train_mask, val_mask, test_mask, labels = load_data(FLAGS.dataset) ...... ..... print("Optimization Finished!") label_dict = {0:"0.0000000e+00",1:"1.0000000e+00",2:"2.0000000e+00",3:"3.0000000e+00",4:"4.0000000e+00",5:"5.0000000e+00",6:"6.0000000e+00"} # 定义标签颜色字典 # 写文件 with open("./embeddings.txt", "w") as fe, open("./labels.txt", 'w') as fl: for i in range(len(outs[3])): fl.write(label_dict[int(list(labels[i]).index(1.))]+"\n") fe.write(" ".join(map(str, outs[3][i]))+"\n")
-
可视化结果为
cora数据集可视化
可以发现GCN对cora数据集的可视化还是很友好的。即便使用的默认参数,也能训练出有意义的节点表示
智能推荐
vue前端数据可视化echart实践经验(二)可视化初始化与刷新
echart可视化时机 前面部分论述了可视化的组件细化,既然我们已经将它细化了,那么接下来讨论父组件将何时触发echart子组件的初始化和刷新。 通过生命周期进行可视化更新? 显而易见的一种方式是通过mounted(),created()等组件生命周期的方式。这种方式当然对于特别简单的场景是可以的,但是在实际可视化项目中,通常我们需要根据不同的请求条件直接对可视化进行刷新,比切换了日期条件、查看不...
TensorFlow 可视化
最近两天在跟着莫烦大神修炼TensorFlow,今天学到的是TensorFlow 可视化,是Tensorboard下显示的。现附上莫烦大神的代码,和本机运行的可视化结果和操作。 学习视频:Tensorflow 搭建自己的神经网络 (莫烦 Python 教程) https://www.bilibili.com/video/a...
使用jQuery列出JavaScript事件
你怎么能列出连接到一个元素JavaScript事件? 我想获得的附加到任何指定的元素JS / jQuery的事件的完整列表和我读来,看见约翰Resig的建议使用此方法: 从理论上讲,这将获得与DIV元素相关联的所有事件。 为了snazz这件事,我发现这个方法在列举的事件十分高效! 用法和输出 其他用途 其他方法 http://james.padolsey.com/javascript/debug-...
IDEA快捷键简化JQuery基本操作
每次用idea进行JQuery代码的输写,少不了要引入jquery标准的使用方式,但是每次去打的话比较麻烦,所以本文通过设置idea的快捷键去简化JQuery操作。 创建一个html页面(输入JQuery语法复制,js版本自行替换) 2. 点击File - Settings -搜索框输入(live)- html/xml -点击“+”号 - Live Template 3. ...
持续集成、持续交付、持续部署
一、术语解释 在软件开发领域,经常提到持续继承(Continuous Integration,CI)、持续交付(Continuous Delivery,CD)和持续部署(Continuous Deployment)等术语。 持续集成 continuous integration (CI) is the practice of merging all developer working copies...
猜你喜欢
数据结构之线段树(点修改)
首先,明确一点,线段树并不是什么神奇的东西,只是巧妙地利用了分治的思想,它用于区间的动态查询问题~ 线段树由很多下面这样的单元组合起来的(我懒地画图了),其中M=L+(R-L)/2(当然也可以写成(L+R)/2,但我们应该养成用前面那种方式找中值的习惯,当L和R特别大的时候,L+R有可能溢出,不过线段树上一般没什么问题),使用线段树的前提是你求的东西必须满足区间加法 &nb...
软件构造-可复用性-Adapter模式
意图:将类的接口转换为客户端期望的另一个接口。 解决类之间接口不兼容的问题; 为已有的类提供新的接口; 目标:对旧的不兼容的组件进行包装,在新系统中使用旧的组件。 图示如下: Adaptee是现有的类; ITarget是我们需要的新的接口; Adapter继承自Adaptee类,并实现了ITarget接口。请注意:它的Request方法是通过调用Adaptee的SpecificRequest方法实...
WindowsMySQL5.7.24zip安装,更改root密码登陆。
MySQL数据库下载路径 1、默认为MySQL最新版本,点击Archives,选择其他版本MySQL数据库 2、在product Version 点击倒三角选择相应版本编号,点击下载zip安装包。 3、将安装包解压到相应文件位置 4、将解压后文件中bin路径进行复制,增加到环境变量PATH中,逐步确定。 5、配置MySQL,使用管理员权限启动cmd,防止因为权限不够,导致命令无法执行。 6、使用d...
MongoDB 简单使用(2):数据导入导出
MongoDB 数据数据导入导出 MongoDB 数据要迁移,使用Navicat 导入卡死,可能是电脑配置不高.工具不行那么就用命令操作. 导出 导出可以用Navicat 等数据库软件,很方便 命令导出 导入 导入使用Navicat 软件容易卡死 docker容器的数据迁移 主要是导入 将数据文件cp 复制导容器内; 执行以上导入命令...
Codeforces Round #506 (Div. 3) - C. Maximal Intersection (思维,模拟)
题目链接 题意 给你N个线段(一条直线上),问删去一个之后,最长公共长度 AC 先考虑不删边,有两种情况 所有直线在一起分布 显然公共部分是排序之后的(第一个右端点 - 最后一个左端点) 直线不在一起分布 这时按照(第一个右端点 - 最后一个左端点)得到的结果是负数,最后可以加个判断,可以解决这个情况 知道上面的两种情况后,可以在O(1)的时间求出最长的公共部分,将所有的线段按照左端点升序,右端点...