国内刊号:51-1196/TP
国际刊号:1001-3695
发布日期:
作者:李卫军,刘世侠,刘雪洋,丁建平,苏易礌,王子怡,
单位:北方民族大学a.计算机科学与工程学院;b.图形图像智能处理国家民委重点实验室,银川750021;
关键词:知识推理,分层强化学习,Bi-LSTM,多头注意力机制,
基金:宁夏高等学校科学研究项目(NYG2024086);宁夏自然科学基金资助项目(2021AAC03215);中央高校科研资助项目(2022PT_S04,2021JCYJ12);国家自然科学基金资助项目(62066038,61962001);;
知识推理作为知识图谱补全中一项重要任务,受到了学术界的广泛关注。针对知识推理可解释性差、不能利用隐藏语义信息和奖励稀疏的问题提出了一种融合Bi-LSTM与多头注意力机制的分层强化学习方法。将知识图谱通过谱聚类分簇,使智能体分别在簇与实体间进行推理,利用Bi-LSTM与多头注意力机制融合模块对智能体的历史信息进行处理,可以更有效地发现和利用知识图谱隐藏的语义信息。Hight智能体通过分层策略网络选择目标实体所在的簇,指导Low智能体进行实体间的推理。利用强化学习智能体可以有效地解决可解释性差的问题,并通过相互奖励机制对两个智能体的动作选择以及搜索路径给予奖励,以解决智能体奖励稀疏的问题。在FB15K-237、WN18RR、NELL-995三个公开数据集上的实验结果表明,提出的方法能够捕捉序列数据中的长期依赖关系对长路径进行推理,并且在推理任务中的性能优于同类方法。
来源:2025年第1期
《计算机应用研究》期刊编辑部