融合多层注意力机制与BiLSTM的知识图谱补全算法研究

本文为博客 VIP 文章,开通 VIP 后可阅读全文

开通 VIP

摘要

【目的】 针对目前大多数知识图谱补全算法无法兼顾局部与全局特征的问题,本文提出一种对实体间的关系路径进行层级划分,并利用双向长短期记忆网络和多层注意力机制进行特征提取的算法,以对知识图谱进行补全。【方法】 首先,结合关系路径上的实体类型和关系得到关系路径序列的向量表示;然后,利用多层注意力机制和双向长短期记忆网络分层级提取序列关键信息;最终通过计算关系路径特征向量与候选关系向量间的相似度得出预测结果。【结果】 在NELL-995和FB15k-237数据集上进行链路预测实验,结果表明,该算法与已有基于关系路径的知识图谱补全算法CNN-BiLSTM等相比,MAP值提高了1.8%,Hits@1指标提高了1.4%;在Kinship数据集上,其Hits@3值达到了0.988。【结论】 本文通过实验证明了所提出的HAN-BiLSTM算法能有效提取关系路径的整体特征和局部特征,从而提高知识图谱补全效果。

关键词: 知识图谱补全; 关系路径推理; 多层注意力机制; 双向长短期记忆网络

引言

知识图谱(Knowledge Graph, KG)是由实体(en-tity)和关系(relation)构成的语义网络,以形如(实体,关系,实体)三元组的形式描述客观物体、抽象概念之间的联系或事物的某些属性。目前已有许多大规模通用领域的知识图谱,如MeteWeb构建的Freebase, 由Bing、Google、Yahoo、Yandex等公司一同构建的语义网Schema.org,Wikipedia构建的Wikidata等,其中包含大量的事实三元组,为推荐系统、问答系统等下游应用提供了支撑[1]。然而,当前大规模知识图谱的构建往往依赖于人工或半自动的方式,通过这些方式构建的知识图谱存在着数据稀疏、三元组缺失的问题,需要进行知识图谱补全(Knowledge Graph Completion,KGC)[2]。

已有对知识图谱补全算法的研究,基本思路主要有两类:一类是基于知识嵌入的知识图谱补全算法,另一类是基于路径的知识图谱补全算法。其中,基于嵌入的算法通过把实体和关系映射进对应的低维向量空间,得到它们的矢量或矩阵表示,以便进行链接预测任务;具有代表性的模型包括TransE[3]、RESCAL[4]、DistMult和ComplEx[5]等。基于知识嵌入的算法在KGC的各个子任务上已经被证明是行之有效的。然而,此类方法多数侧重关注图谱中实体之间的直接关系,而忽视图谱中实体之间由多个实体和关系所组成的关系路径的存在。

基于路径的知识图谱补全算法常常将知识图谱补全任务转换为分类任务,主要通过将包含两个目标实体的路径作为特征,对目标关系进行学习,例如PRA[6]、Path-RNN[7]、Single-Model[8]、Att-Model[9]等。路径查找算法(Path Ranking Algorithm, PRA)证明了在两个实体之间包含关系类型的关系路径可以有效用于知识图谱补全任务,且能较好地解决多步知识推理问题。Path-RNN等模型使用循环神经网络(Recurrent Neural Network, RNN)沿这些路径进行向量化建模,把关系路径嵌入到低维向量空间,通过计算路径向量与待预测关系向量之间的相似度进行关系补全,相比PRA有效缓解了由于路径数量过多导致的特征空间膨胀问题。CNN-BiLSTM[10]模型利用双向长短期记忆神经网络(Bidirectional Long Short-Term Memory Networks, BiLSTM)[11]从正反两个方向对关系路径进行向量化建模,并提出了利用注意力机制捕捉候选关系与两个实体之间每条路径的语义相关性。然而,这些算法在两个指定实体之间存在多条关系路径时,往往认为只有相似度最大的路径对推理具有贡献或所有关系路径对推理过程具有同等的贡献,采用对路径信息进行最大池化或平均池化的处理方法,这与知识图谱的实际情况是不相符的。

事实上,如图1所示,在两个实体之间的单条关系路径上,实体和关系出现的顺序包含有价值的语义信息,如关系三元组(美国,官方语言,英语)。即使是同一个关系,当从路径的正反两个方向考虑时,对关系的推理所起到的作用也是不同的。如图所示,对于包含“官方语言”这一关系的三元组而言,当头实体确定为“美国”时,即可推理出该三元组的尾实体为“英语”;但如果仅确定尾实体为“英语”,则难以推理出头实体究竟是什么,因为将本国的官方语言规定为英语的国家实体不仅有美国一个,即“官方语言”这一关系在此处为一个多对一的关系。而当具体到某一条关系路径,如(加勒比海盗→导演→戈尔·维宾斯基→使用→英语)时,不同实体和关系的重要程度也是有差异的。也就是说,在对实体对(加勒比海盗,英语)之间缺失的关系“对白语言”进行补全时,一个实体对之间可能存在的不同关系路径在语义上所发挥的作用,其大小显然是不同的。

图1

1   两个不相邻实体之间的关系路径示意

Fig.1   Example of relation paths between two non-adjacent entities

本文提出了一种融合多层注意力机制与双向长短期记忆网络的知识图谱补全算法。该算法的创新之处在于:(1)在知识图谱补全任务中引入了多层注意力机制,把实体间的关系路径信息分为实体/关系层级和关系路径层级两个层级进行处理,在对知识图谱进行补全时兼顾了每条关系路径上的局部特征与实体之间多条关系路径的全局特征;(2)在实体/关系层级上,结合实体类型信息和关系类型,使用双向长短期记忆网络获取关系路径正反两个方向的语义信息,并使用注意力机制提取实体/关系序列的特征,得到单条关系路径的向量表示;(3)在关系路径层级上使用注意力机制,获取实体间不同关系路径与候选关系之间的语义相似程度,加权求和得到综合考虑两实体之间所有关系路径的向量表示。为验证所提出算法的效果,在四个不同的标准数据集(NELL995、FB15k-237、Kinship、Nations)上执行了链路预测任务,并将实验得到的结果与多种图谱补全方法在相同数据上的重复实验对比;对于所提出的算法本身也进行了消融实验以分析各阶段采用策略对最终结果的影响。实验结果表明,融合多层注意力机制与双向长短期记忆网络的知识图谱补全算法与以往基于关系路径的知识图谱补全算法相比,实现了对局部特征和全局特征的提取,在知识图谱补全任务中表现出了更好的性能。

1 相关工作

论文分三部分完成相关工作的综述,包括:知识图谱补全算法的研究现状;基于关系路径的知识补全方法模型;基于注意力机制的模型。

1.1 知识图谱补全

已有的知识图谱补全算法主要可以分为知识嵌入算法和关系路径推理算法两类。基于知识嵌入的算法通过表示学习,把图谱映射入低维度的向量空间,通过在向量空间中计算实体、关系的距离、相似度等方式,进行知识图谱补全[3-4,11-12]。典型的基于知识嵌入的模型有以TransE[3]为代表的翻译模型、结构表示模型(Structured Embedding, SE)[14]等。在将单词转化为词向量的研究中,Mikolov等发现词向量空间存在不平衡现象[15],受该现象启发,Bordes等提出TransE模型。在TransE模型中,对于一个知识三元组(h,r,t),其中的关系r被视为头实体h和尾实体t之间的一个翻译,在学习过程中的优化目标为尽可能使h+r的值与t相一致,若有三元组(h,r,t)存在,希望h+r≈t,否则h+r应尽量远离t。TransE模型相对其他模型而言较为简单,且其计算复杂度低,在简单关系的补全上性能较好,但在处理复杂关系时效果仍有待提升。Zhen等人提出了TransH模型[15],在TransE模型上,对每一个关系增加了一个对应的超平面,使实体的表示不再唯一,对应每一个不同关系时同一实体在对应的关系超平面中具有不同的嵌入表示,解决了TransE对于难以区分满足同一头实体h的同一关系r,可能存在的多个对应尾实体的问题。TransE模型把所有实体和关系投影进同一向量空间,但实际上每个实体都有多个不同方面的含义和属性,不同的关系在与实体相连时也对应了这些实体在不同方面的含义和属性,把实体和关系放在同一空间中考虑是无法反映这种性质的。TransR[16]模型把实体和关系分别进行处理,每个三元组都有一个对应的关系空间,对所有的三元组都单独进行学习。与先前的嵌入模型相比,TransR的效果有了较为明显的提升,但在该模型中,对于某一个关系r,该关系所连接的各个头、尾实体的类型和属性差异可能很大,但需要映射到同一个投影矩阵中;在TransR模型中,关系r的投影矩阵仅取决于关系r本身,无法反映该关系相关的实体,以及这些实体和关系共同作用的情况;由于TransR模型需要计算大量不同向量空间之间的投影,当数据集较大时所需的计算资源极大。为了解决上述问题,Ji等人设计了TransD[17]模型,设置了两个投影矩阵,把头尾实体投影到两个单独的关系空间中,既使得这两个投影矩阵与关系和头/尾实体都有关,也缓解了参数过多的现象。

结构表示模型[14]用d维向量表示实体,用与关系r相关的两个矩阵Mr,1,Mr,2∈Rd×dMr,1,Mr,2∈Rd×d把关系r所连接的两个实体对应的向量嵌入到关系r对应的向量空间。但是结构表示模型学习到的两个不同的矩阵仍然无法准确反映出实体和关系之间存在的对应关系。为缓解该问题,单层神经网络模型SLM使用单层神经网络,通过一个非线性计算,定义了三元组的损失函数。该模型引入的非线性计算简单表示了实体和关系之间的联系,但该联系仍不够紧密,且非线性计算提高了模型的计算复杂度。张量神经网络模型[18]利用了双线性张量层直接关联了两个实体的向量表示,在小规模数据集上具有较好的效果。但是NTN较高的计算复杂度导致该模型的运算开销过大,在知识图谱规模较大的时候难以应用。

Yang等提出了DistMult[19]模型,方法是将NTN和TransE结合用于知识图谱补全,再改模型中关系以对角矩阵的形式进行表示和运算。Trouilon等人提出ComplEx模型[5]对DistMult进行了拓展,把原有的实数嵌入空间改为复数空间,以便更好地对非对称关系进行建模。ConvE[20]在ComplEx的基础上进行改进,通过将多层卷积网络模型应用于关系三元组,取得了稍高于ComplEx的性能。

1.2 基于关系路径的知识图谱补全方法

上述关于知识图谱补全方法研究内容的重点主要集中在嵌入单独的实体和关系上,对于两个实体之间关系路径的利用效果不好。在本研究中,我们主要关注如何利用实体之间存在的关系路径完成知识图谱补全任务。路径排序算法(Path Ranking Algorithm, PRA)[6]把关系路径视为特征,通过随机游走、深度优先搜索、广度优先搜索等方法完成特征抽取任务后,生成实体间路径集合,将随机游走概率作为样本的特征值,并为每种关系单独训练一个二分类器,以判断两个不相邻的实体之间满足目标关系的可能性。Gardner等在PRA模型中引入文本语料库作为推断过程中的额外依据[21];Gardner和Mitchell等改进了PRA特征抽取的方法[22],以生成更完整的关系路径;Wang等人在PRA的基础上考虑了某些关系之间的关联[23],以降低图谱中某些关系的稀疏性对补全效果带来的影响。但是总体而言,PRA在处理低频关系和低联通图时效果不好,难以解决图谱中一些关系的稀疏性带来的问题,且路径抽取的效率较低。

为解决以上问题,Neelakantan等提出了Path-RNN模型[7],将每条路径视为一个关系序列,使用RNN对该路径序列进行编码,得到路径特征向量。最后,关系路径与目标关系的相关性根据它们向量表示的点积进行评估。当实体对之间,一定长度以内的关系路径不唯一时,该模型忽略其他路径,选择向量表示点积最大的一条路径。Neelakantan等还提出通过几个路径组合运算符来提高Path-RNN的性能,包括对几条关系路径的表达进行平均池化、最大池化等方法。Das等通过强化学习算法(Reinforcement Learning, RL)[8]查找关系路径,取得了一定的提升。Lan等提出通过关系路径构造自然语言句子,将这些句子输入预训练语言模型BERT得到句子的向量表达,以利用关系路径中实体和关系所包含的语义信息,在其构建的中文医学知识图谱MedKG上取得了较好的效果[23]。

1.3 基于注意力机制的模型

在研究人脑处理信息机制的过程中,Treisman等提出了注意力机制模型[25],该模型认为,通过计算输入信息的概率分布,得到能反映不同重要程度信息的具体注意力权重,突出输入信息中的关键信息。Bahdanau等首先在机器翻译任务中使用

堆叠多层bi-lstm的方法 自己在搭建多层双向lstm网络的时候,看了很多的资料,一开始的时候搭建都是不成功的,后来看了官方的资料还有一些博客,使用了2种方法搭建成功了! 方法1: n_hidden_units=50 # 隐藏层神经元数目 num_layers=3 # 双向lstm神经网络的层数 n_steps=15 n_inputs=32 X=tf.placeholder(dtype=tf... 阅读详情

相关推荐

BERT遇上知识图谱:预训练模型知识图谱相结合的研究进展

转载自AI科技评论 随着BERT等预训练模型横空出世,NLP方向迎来了一波革命,预训练模型在各类任务上均取得了惊人的成绩。随着各类预训练任务层出不穷,也有部分研究者考虑如何在BERT这一类模型中引入或者强化知识图谱中包含的信息,进而增强BERT对背景知识或常识信息的编码能力。本文主要关注于如何在BERT中引入知识图谱中信息,并survey了目前已公布的若干种方法,欢迎大家批评和交流。 1、《ERNIE: Enhanced Language Representation with Informative E.

朝闻道 1578

BiLSTM分类】双向长短时记忆神经网络结合多头注意力机制BiLSTM-Mutilhead-Attention数据分类(多输入单输出)【含Matlab源码 4635期】

双向长短时记忆神经网络结合多头注意力机制BiLSTM-Mutilhead-Attention数据分类(多输入单输出) 完整的代码,方可运行;可提供运行操作视频!适合小白!

订阅付费专栏Matlab(奶茶价版)或下载付费资源,可赠送奶茶价版付费专栏指定代码1份; 1562

AI论文写作助手:提升学术效率的NLP知识图谱技术

自然语言处理(NLP)知识图谱技术的结合正在重塑学术写作流程。通过BERT+BiLSTM混合模型实现文献智能解析,系统能自动提取核心论点、实验方法和数据结论,构建三维知识图谱。这种技术方案解决了传统学术写作中文献利用率低、逻辑结构混乱等痛点,特别适合处理海量文献(如每篇论文平均需阅读47篇文献的场景)。在实际应用中,该技术使文献阅读时间减少63.8%,格式错误降低87.9%,显著提升了写作效率。对于需要频繁进行学术写作的大学生和研究人员,这类AI写作助手能有效优化从文献综述到终稿格式化的全流程。

weixin_33735077的博客 408

构建数码产品知识图谱:从数据采集到知识融合

构建数码产品知识图谱:从数据采集到知识融合 1. 背景介绍 1.1 知识图谱的重要性 在当今的数字时代,数据已经成为了企业和组织的关键资产。然而,简单地积累海量数据是远远不够的,我们需要有效地组织和利用这些数据,将其转化为可操作

AI天才研究院 1334

情感分类——BiLSTM

序 Bi-LSTM的理论就不再说了,本文在前文TextCNN的基础上,将模型改为Bi-LSTM,本意是比较模型效果,但是实际结果不太理想,有过拟和问题。 最最前面 写着写着感觉变了味道,本来准备水一下,结果拓展了很多出来,很零碎。 如果你对理论不太清楚,可以去看:http://colah.github.io/posts/2015-08-Understanding-LSTMs/ 如果你对ten...

qq_40240102的博客 3738

Knowledge Graph Completion(知识图谱补全

知识图谱补全算法能让知识图谱变得更加完整,按照能否处理新实体或者新关系,可以将知识图谱补全算法分成两类: 静态知识图谱补全(Static KGC),该场景的作用是补全已知实体之间的隐含关系。仅能处理实体以及关系都是固定的场景,扩展性较差 动态知识图谱补全(Dynamic KGC),涉及不止知 识图谱G中的实体或关系,该场景能够建立知识图谱外界的关联,从而扩大知识图谱的实体集、关系集以及三元组集。可以处理含有新实体或者新关系的场景,能够构造动态的知识图谱,具有更好的现实意义 虽然知识图谱能提供高质量的结

nakaizura 2万+

知识图谱技术对自然语言处理深层语义分析的影响启示研究

知识图谱作为结构化知识的重要表示形式,正在深刻改变自然语言处理(NLP)领域的技术范式。知识图谱通过将人类知识组织成机器可理解的结构化形式,为NLP系统提供了丰富的背景知识和语义理解能力 。在当前人工智能快速发展背景下,深层语义理解已成为NLP领域的核心挑战,而知识图谱的各项技术为此提供了关键解决方案。本报告系统分析知识图谱的表示、存储、抽取、融合和推理等技术,及其对NLP深层语义分析的具体影响启示。

训意学的博客 1100

从文本构建知识图谱:信息抽取、共指消解知识融合

知识图谱作为结构化知识表示的重要形式,在智能搜索、问答系统、推荐引擎和决策分析中发挥着关键作用。本文系统阐述从非结构化文本构建知识图谱的完整技术流程,涵盖信息抽取、共指消解知识融合三大核心环节。在信息抽取部分,详述命名实体识别、关系抽取和事件抽取的主流方法演进;在共指消解部分,解析提及检测、指代链构建跨句实体对齐的关键模型;在知识融合部分,深入探讨实体链接、冲突消解知识库补全的策略。文章结合经典模型前沿技术,为从文本自动构建高质量知识图谱提供了全面的技术参考。

AladdinEdu,你的AI学习实践工作坊。让想法落地,让研究加速。助力高校AI人才成长,点亮创新未来。 277

门控融合机制

门控融合机制通过动态权重分配实现多源信息的高效整合,广泛应用于多模态学习、医学影像和自然语言处理等领域。其核心是使用门控单元(如sigmoid函数)生成权重向量,自适应调节不同模态或特征的贡献度。该机制能注意力机制、Transformer等结合,有效解决模态冲突、信息冗余等问题,在蛋白质表征学习、视频分析等任务中展现出优越性能。此外,类似原理在生物电子学等领域也有重要应用,体现了跨学科研究价值。

weixin_71288092的博客 6404

NLP技术突破:浅层深层语义分析全解析

本文系统分析了自然语言处理中浅层深层语义特征的区别。浅层语义(如语义角色标注)技术成熟,在CoNLL-2012数据集上F1分数达89.07%;深层语义则依赖预训练模型知识图谱融合,仍在发展中。研究揭示了计算效率、伦理风险和知识幻觉三大挑战,并指出2025年后技术将向轻量化架构和多模态融合发展。文章为NLP研究提供了清晰的技术图谱,展现了从"读懂"到"理解"的技术演进路径。

训意学的博客 2471

AI如何提升学术写作规范效率

学术写作规范是科研工作的重要基础,涉及文献引用、术语统一、格式标准等多个维度。传统写作工具主要解决语法层面的问题,而基于NLP和知识图谱的智能辅助系统能深入理解学科语境,实现从文献管理到投稿的全流程优化。这类系统通常采用BERT、BiLSTM-CRF等模型构建语义关联网络,通过动态规则引擎适配不同学科的写作规范。在学术出版领域,AI写作辅助可显著降低格式错误率,缩短审稿周期,特别有助于跨学科研究和新兴领域的发展。以基因编辑和临床研究为例,智能系统能自动识别术语冲突,确保符合CONSORT声明等专业标准。

weixin_34126557的博客 410

基于AI的PDF复杂表格结构识别智能解析(方案1)

1 总体思路本方案采用 “多模态输入 - 分层处理 - 协同输出” 的技术架构,整体分为数据预处理层、核心任务处理层、融合决策层和结果输出层四个部分,各层通过标准化数据接口实现高效协同,具体架构如下:(1)数据预处理层:统一处理 PDF 原生文件扫描件输入,将 PDF 文本流图像流分离,对扫描件执行超分辨率重建倾斜校正;采用 OCR 技术(如 PaddleOCR)提取图像中的文本信息及坐标,构建 “文本 - 坐标 - 图像特征” 三位一体的基础数据结构。​。

yubo0509的博客 1322

音诺ai翻译机利用Zhihu ZH-Z1实现知识图谱个性化推送

音诺AI翻译机融合Zhihu ZH-Z1知识图谱,通过语义建模、动态推理个性化推送,实现从语言转换到认知理解的跨越,提升翻译准确性用户体验。

weixin_33814090的博客 1067

仅限本周开放|GMAT AI备考效能评估工具(含ETS官方题库行为轨迹比对模块),免费生成专属「提分热力图」瓶颈突破路线图

AI准备GMAT考试,高效定位提分突破口!本周限时开放GMAT AI备考效能评估工具,融合ETS官方题库行为轨迹比对,免费生成「提分热力图」个性化瓶颈突破路线图。适用于冲刺阶段考生,精准识别弱项、优化复习路径,值得收藏。

StepLens的博客 159

数字人文视角下藏医学古籍知识发现研究

摘要:本毕业设计构建了一个基于数字人文的藏医学古籍研究平台,整合大数据和机器学习技术,实现藏医古籍的数字化处理智能分析。系统包含数据采集、知识抽取、机器学习和智能问答四大模块,采用藏文OCR识别、实体关系抽取、知识图谱构建等核心技术,支持古籍分类、方剂分析、疗效预测等功能。创新性地融合多学科方法,针对藏医古籍特点优化算法,为学术研究、临床实践和文化传承提供智能化工具,推动传统医学知识的现代化应用。

2501_93059031的博客 627

【AI语义理解新突破】:Open-AutoGLM关联分析的7个关键优化点

提升AI语义理解准确率,Open-AutoGLM语义关联分析强化实现多场景文本深度匹配。基于7大优化策略,增强上下文感知逻辑推理能力,适用于智能客服、知识图谱构建等场景,显著提升分析效率精度,值得收藏。

DebugLoom的博客 821

法律行业——合同审查AI律师

AI技术从“工具辅助”跃升为“生态共建者”,推动行业效率、服务模式和治理体系的全方位革新。‌:索未来科技集团的AI智能体已实现合同风险点识别准确率98.7%,并成功应用于跨国并购合同审查,将原本需要2周的尽调周期缩短至3天‌35。‌,推动法律行业从“工具赋能”向“生态重构”演进。‌:当前法律AI已从“规则驱动”转向“数据+知识双驱动”模式,未来将进一步融合多模态理解因果推理能力‌。‌三方面展开,结合代码案例行业实践,详解AI理解法律语言的技术路径‌。‌

zyw38121913的专栏 1696
上一篇: 数据可信交易体系的制度构建——基于场内交易视角
下一篇: 垂直领域知识图谱构建及应用平台的设计与实现
罗思付之技术屋
博客等级 码龄3年 2805粉丝 · 519原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

罗思付之技术屋

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值