时态图网络:即使很久不发朋友圈,也能知道你的新兴趣( 三 )
为了让这些模块能够影响损失值 , 我们需要在预测批处理交互之前更新内存 。 但是 , 由于内存中已经包含了我们试图预测的信息 , 因此这会导致内存泄漏 。
为了解决这个问题 , 我们提出的方法是用来自前一个批处理的信息来更新内存 , 然后再预测交互 。 下图显示了训练内存相关模块所必需的TGN的操作流程:
本文插图
图示为训练内存相关模块所需的TGN操作流程 。 我们引入了一个叫做“原始消息存储”(raw message store)的新组件 , 用于存储模型已经处理过的交互 。 raw message store存储了计算消息(我们称之为raw messages)所必须的信息 。 这样模型就可以将交互时进行的内存更新推迟到后续的批处理 。 首先 , 用存储在前一个批处理(1和2)中的原始消息来计算信息 , 并用此信息来更新内存 。 然后可以用这一更新过的内存(即图中灰色连线)(3)来计算嵌入 。 这样就使得内存相关模块的计算能够直接影响损失值(4和5) , 并且它们会接收到一个梯度 。 最后 , 此批处理交互的原始消息被存储在raw message store(6)中 , 以供后续的批处理使用 。
在各种动态图的大量实验研究中 , TGN在未来边缘预测和动态节点分类的任务上 , 无论在精度还是速度上都明显优于竞争方法 。
维基百科就是这样一个动态图 , 其中用户和页面是节点 , 用户编辑页面就是进行交互 。 将编辑文本这一交互行为进行编码 , 就可作为交互特征 。 在这个例子中 , 模型的任务就是预测用户在给定时间内会编辑哪个页面 。 我们用基线方法比较了TGN的不同变式:
本文插图
图示为基于维基百科数据集 , 在未来链路预测的预测精度和时间方面 , 比较不同配置的TGN和已有的方法(如TGAT和Jodie) 。 我们希望更多的论文能够以严谨的方式报告这两个重要数据 。
这项消融研究揭示了不同TGN模块的重要性 , 并帮助我们得出了一些一般性结论:
- 内存很重要:内存的缺失会导致模型性能的大幅下降 。
- 使用嵌入模块(而不是直接输出内存状态)非常重要 , 基于图注意的嵌入性能最好 。
- 由于1-hop临近节点的内存能使模型间接访问1-hop临近节点的信息 , 因此在有内存的情况下 , 模型仅仅使用一个图注意层就足够了(这样就极大地减少了计算时间) 。
原文链接:
https://towardsdatascience.com/temporal-graph-networks-ab8f327f2efe
本文插图
本文插图
推荐阅读
- 网络支付|个人收款码与个人经营收款码有何不同?央视科普
- 网络|重新通网了!汤加火山喷发引发海啸一个月后:与世界恢复联系
- Wi-Fi|法国父亲干扰器断网克制孩子网络沉迷 功率太大致全镇断网
- 央视|2022央视网络春晚阵容官宣 播出时间敲定:王冰冰等七位美女主持加盟
- 模仿|鹦鹉完美模仿iPhone手机铃声走红网络 网友:让你模仿 没让超越
- 联发科|比Wi-Fi 6快2.4倍!联发科全球首秀Wi-Fi 7:将真正取代有线网络
- 微软|微软收购动视暴雪带动网络狂欢 网友疯狂玩梗吐槽
- 苹果|漏洞太多 苹果iPhone被要求关闭2G网络:安卓已提前实现
- 电影|官方鼓励网络视频平台限时低价电影放映:增加春节期间文化体育节目供应
- 谷歌|2G网络漏洞威胁大 新版安卓将加入开关允许用户手动关闭
