首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >HippoRAG >HippoRAG 的离线索引阶段是怎样构建知识图谱的?

HippoRAG 的离线索引阶段是怎样构建知识图谱的?

词条归属:HippoRAG

1. 三元组抽取

离线阶段的第一步,是用大语言模型对语料库逐段执行开放信息抽取,将非结构化文本转化为无模式知识图谱三元组,作为图谱的节点与边来源。

2. 同义词边补充

由于开放抽取得到的节点往往是表面表述不同的短语,系统进一步用检索编码器(如 ColBERTv2)计算节点间向量相似度,对语义相近但表述不同的节点添加"同义词边",将它们关联起来,从而增强图谱对语义变体的鲁棒性。

3. 图谱持久化

抽取与关联完成后,系统将所有三元组与同义词边合并为一张持久化的知识图谱,并为每个节点保存向量表示,供在线检索阶段直接调用。整个离线索引过程一次性完成,新知识可通过新增图谱边的方式持续整合,而无需重新训练大语言模型。

相关文章
【RAG论文精读】给RAG引入海马体记忆索引理论HippoRAG: Neurobiologically Inspired Long-Term Memory fo
当前的大型语言模型 (LLMs) 虽然在知识存储方面取得了显著进展,但仍然缺乏高效整合新知识的能力。传统的检索增强生成 (RAG) 方法虽然允许向静态模型中添加新知识,但仍然无法有效地跨段落整合信息。为了解决这一问题,本文提出了 HippoRAG,一个受人类长期记忆中海马体索引理论启发的检索框架,旨在实现更深入、更高效的知识整合。
中杯可乐多加冰
2024-12-22
1.4K0
深度解析仿人脑记忆搜索的HippoRAG2,全面对比GraphRAG、KAG、LightRAG和PIKE-RAG,成本缩减12倍
持续获取、组织和利用知识的能力是人类智能的关键特征,而 AI 系统若想充分发挥潜力,也必须具备这一能力。近期,一些 RAG 方法通过引入知识图谱等结构来增强对信息的理解和联想能力,部分弥补了这些不足。然而,这些增强方法在基础事实记忆任务上的表现通常远逊于标准 RAG。HippoRAG 2[1] 基于 HippoRAG 采用的 个性化 PageRank(Personalized PageRank, PPR)算法,并进一步优化了信息整合方式,同时增强了 LLM 在在线检索中的作用。
AgenticAI
2025-03-18
3.2K0
HippoRAG:模拟大脑记忆思索机制的 RAG
人类大脑通过不断积累和更新知识来适应环境,而大型语言模型(LLMs)虽具智能,却缺乏这种动态更新能力。为解决这一问题,研究人员开发了一种名为“HippoRAG”的新框架,模仿了大脑新皮质和海马体的工作机制,显著提升了多跳问题解答的性能,比现有 RAG 方法高出 20%。HippoRAG 不仅成本低、速度快,在单一检索步骤中还优于迭代 IRCoT 方法。这展示了如何将生物学原理应用于提高 LLMs 的效率。RAG 通过将数据集分块并索引于矢量数据库中,实现高效检索。然而,传统 RAG 在涉及多块知识整合的现实任务(如法律、医学和科学领域的多跳问题解答)上表现不佳。以前的研究,如 Self-Ask[1] 和 IR-CoT[2],通过多重检索和 LLM 生成迭代连接知识块,但在处理信息分散且无直接联系的任务上仍有不足。
AgenticAI
2025-03-18
1.2K0
什么是人工智能的知识图谱?知识图谱的组成、构建、应用有哪些?
人工智能(Artificial Intelligence,AI)是一种通过计算机模拟人类智能的技术,其应用范围越来越广泛。知识图谱(Knowledge Graph,KG)则是人工智能技术中的重要组成部分,它是一种结构化的、语义化的知识表示方式,能够帮助计算机理解和处理人类语言。
网络技术联盟站
2023-05-14
31.4K0
解读知识图谱的自动构建
‍【引】在AI领域, 知识系统过时了么?在《大模型应用的10种架构模式》中, 知识图谱与大模型的结合是一种重要的应用方式。知识图谱可以辅助大模型应用的推理,大模型也可以辅助知识图谱的构建,二者是可以相辅相成的。在国庆假期中,读了一篇论文“A comprehensive survey on Automatic Knowledge graph Construction”(https://arxiv.org/abs/2302.05019),整理成文。
半吊子全栈工匠
2024-11-07
1.7K0
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券