GEOZ

知识图谱突破LLM局限:Graph RAG 2024指南

2026/1/24
知识图谱突破LLM局限:Graph RAG 2024指南
Graph RAG (Retrieval Augmented Generation) enhances LLM performance by integrating knowledge graphs with retrieval mechanisms, addressing limitations like domain-specific knowledge gaps and real-time information access. It combines entity extraction, subgraph retrieval, and LLM synthesis to provide accurate, context-aware responses. Graph RAG(检索增强生成)通过将知识图谱与检索机制结合,提升大语言模型性能,解决领域知识不足和实时信息获取等局限。它结合实体提取、子图检索和LLM合成,提供准确、上下文感知的响应。

Introduction

大语言模型(LLM)彻底改变了我们与信息交互的方式,在理解和生成类人文本方面展现出卓越的能力。然而,其固有的设计和训练方法存在显著的限制,这些限制会影响其在专业化或动态环境中的可靠性和适用性。与此同时,检索增强生成(RAG)及其演进形式 Graph RAG 等先进技术应运而生,通过将 LLM 建立在外部结构化知识源之上,来弥合其中的一些差距。本文探讨了当代 LLM 的核心局限性,并深入研究了 Graph RAG 的机制和实现策略,概述了知识图谱如何增强生成式 AI 系统。

Key Limitations of Large Language Models

尽管功能强大,但 LLM 并非全知全能。其性能受到几个基本的架构和数据相关限制的约束。

1. Insufficient Domain-Specific Information

LLM 主要是在庞大的公开可用数据集上进行训练的。虽然这提供了广泛的通用知识,但从本质上讲,这意味着它们无法获取非公开的、特定领域的或专有信息。因此,当被问及小众主题、公司内部数据或近期未发表的研究时,LLM 可能会提供不完整、通用或不准确的回答。

2. Potential for Hallucination and Misinformation

LLM 通过根据其训练数据预测最可能的词序列来生成回答。当面对超出其训练分布范围的查询,或需要其知识截止日期之后的事实准确性时,它们可能会产生“幻觉”——生成听起来合理但错误或完全捏造的信息。这不是欺骗行为,而是其生成性质的统计假象。

3. Inability to Access Real-Time Information

最先进 LLM 的训练过程计算密集,并且是分阶段进行的。因此,它们的知识是静态的,冻结在最后一次训练更新的时间点。它们无法访问或整合实时数据、新闻或近期事件,这使得它们不适合需要最新信息的任务。

4. Immutable Pre-Training Data

LLM 的基础知识是在固定语料库的预训练过程中编码的。如果该语料库包含错误、偏见或过时信息,这些缺陷就会嵌入到模型的参数中,并且在部署后极难纠正或“忘却”。模型将继续基于这个不完美的基础生成回答。

5. Lack of True Long-Term Memory

在跨会话的对话或任务上下文方面,LLM 是无状态的。虽然它们可以在单个交互窗口内(受令牌数量限制)保持上下文,但它们不具备对过去交互的持久记忆。这使得它们不适合需要基于先前建立的理解或上下文进行构建的复杂、多会话任务。

What is Graph RAG?

检索增强生成(RAG)是一种框架,通过在推理时从外部知识源动态检索相关信息,来增强 LLM 的生成能力。Graph RAG 是 RAG 的一种专门变体,它利用知识图谱(KG)作为其检索主干。

知识图谱将信息结构化为实体(节点)及其之间关系(边)的网络。Graph RAG 利用这种结构化表示来执行更精确和具有上下文感知能力的检索。它将知识图谱视为一个庞大的、相互关联的词汇表,其中实体和关系是基本单元。

其核心思想很简单:针对用户查询,提取关键实体,检索围绕这些实体的相关子图,并利用这种结构化的上下文来支撑 LLM 的生成,从而产生更准确、事实一致性更强的答案。

A Simple Graph RAG Pipeline

以下伪代码说明了一个基本的 Graph RAG 工作流程:

def simple_graph_rag(query_str, nebulagraph_store, llm):
    # Step 1: Extract entities from the query
    entities = _get_key_entities(query_str, llm)
    # Step 2: Retrieve a contextual subgraph based on entities
    graph_rag_context = _retrieve_subgraph_context(entities)
    # Step 3: Synthesize the final answer using the context
    return _synthesize_answer(query_str, graph_rag_context, llm)

Step 1: Entity Extraction

此阶段识别用户查询中的核心实体(人物、地点、概念),通常使用 LLM 本身或专用的命名实体识别(NER)模型。可以扩展同义词以提高检索召回率。

def _get_key_entities(query_str, llm=None, with_llm=True):
    # ... entity extraction logic ...
    return _expand_synonyms(entities)

Step 2: Subgraph Retrieval

利用识别出的实体,系统查询知识图谱以获取周围的子图,通常探索到指定深度(例如,2跳)的关系。该子图包含与查询相关的结构化上下文。

def _retrieve_subgraph_context(entities, depth=2, limit=30):
    # ... subgraph querying logic ...
    return nebulagraph_store.get_relations(entities, depth, limit)

Step 3: Answer Synthesis

检索到的子图(通常转换为文本格式)与原始查询一起作为增强上下文输入到 LLM 中。一个精心设计的提示词会指示 LLM 主要根据提供的上下文生成答案。

def _synthesize_answer(query_str, graph_rag_context, llm):
    return llm.predict(PROMPT_SYNTHESIZE_AND_REFINE, query_str, graph_rag_context)

Bottlenecks of Traditional RAG and The Graph Advantage

传统的 RAG 通常依赖于对非结构化文本块(例如,文档段落)的向量相似性搜索。这种方法有两个主要瓶颈:

**缺乏训练数据/理解能力**:检索器可能难以理解需要关系推理的复杂查询,因为它基于词袋或语义嵌入进行操作,没有明确的关系结构。
**文本理解不足**:如果措辞不同,仅基于语义相似性检索文本块可能会遗漏关键信息,并且无法执行多跳推理(例如,“A 公司投资的那本书的作者”)。

Graph RAG 通过使用知识图谱来解决这些问题。实体和关系的显式表示允许:

  • 精确检索:直接定位特定实体及其关联事实。
  • 关系推理:遍历边以执行多跳查询并发现间接联系。
  • 结构化上下文:为 LLM 提供清晰的关系上下文,而不是可能有噪声的文本段落。

Seven Methods for Graph Exploration with LlamaIndex

LlamaIndex 框架提供了用于实现 Graph RAG 的多功能工具。我们在此概述七种不同的查询/探索方法。

Method 1: KG Vector-Based Retrieval

query_engine = kg_index.as_query_engine()

这是默认的开箱即用方法。它通过向量相似性查找 KG 实体,检索连接的文本块,并可选择性地探索关系。它简单,但对于语义搜索有效。

这种方法通过向量相似性查找 KG 实体,获取连接的文本块,并选择性探索关系。是 LlamaIndex 基于索引构建的默认查询方式。它非常简单、开箱即用,不用额外的参数。

Method 2: KG Keyword-Based Retrieval

kg_keyword_query_engine = kg_index.as_query_engine(
    include_text=False,
    retriever_mode="keyword",
    response_mode="tree_summarize",
)

此方法使用关键词匹配(retriever_mode="keyword")来查找相关的 KG 实体及其三元组。include_text=False 意味着它仅使用原始三元组(主语、谓语、宾语)。response_mode="tree_summarize" 有助于从检索到的图结构生成简洁的摘要。

这个查询用了关键词来检索相关的 KG 实体,来获取连接的文本块,并选择性地探索关系以获取更多的上下文。而参数 retriever_mode="keyword" 指定了本次检索采用关键词形式。include_text=False:查询引擎只用原生三元组进行查询,查询不包含对应节点的文本信息;response_mode="tree_summarize":返回结果(响应形式)是知识图谱的树结构的总结。这个树以递归方式构建,查询作为根节点,最相关的答案作为叶节点。tree_summarize 响应模式对于总结性任务非常有用。

Method 3: KG Hybrid Retrieval

kg_hybrid_query_engine = kg_index.as_query_engine(
    include_text=True,
    response_mode="tree_summarize",
    embedding_mode="hybrid",
    similarity_top_k=3,
    explore_global_knowledge=True,
)

设置 embedding_mode="hybrid" 结合了向量和关键词搜索进行检索,并对结果去重。explore_global_knowledge=True 允许搜索考虑直接邻居之外更广泛的图上下文,这对复杂查询有益。

通过设定 embedding_mode="hybrid",指定查询引擎为基于向量的检索和基于关键词的检索二者的混合方式,从知识图谱中检索信息,并进行去重。KG 混合检索方式不仅使用关键词找到相关的三元组,它也使用基于向量的检索来找到基于语义相似性的相似三元组。所以,本质上,混合模式结合了关键词搜索和语义搜索,并利用这两种方法的优势来提高搜索结果的准确性和相关性。explore_global_knowledge=True:指定查询引擎是否要考虑知识图谱的全局上下文来检索信息。当设置 explore_global_knowledge=True时,查询引擎不会将其搜索限制在本地上下文(即,一个节点的直接邻居),而是会考虑知识图谱的更广泛的全局上下文。

Method 4: Native Vector Index Retrieval (Non-Graph Baseline)

vector_index = VectorStoreIndex.from_documents(documents)
vector_query_engine = vector_index.as_query_engine()

这种方法完全绕过知识图谱,仅依赖于文档块的向量索引。它作为性能基线,用于比较纯向量搜索与图增强方法。

这种方式完全不处理知识图谱。它基于向量索引,会先构建文档的向量索引,再从向量索引构建向量查询引擎。

Method 5: Custom Composite Query Engine (KG + Vector)

此方法涉及创建一个自定义检索器,该检索器从 KG 检索器和向量检索器获取结果,然后合并它们(使用并集 OR 或交集 AND 逻辑)。输入内容中提供的 CustomRetriever 类演示了这一点,它结合了 KGTableRetrieverVectorIndexRetriever 的结果。

LlamaIndex 构建了一个 CustomRetriever。如上所示,你可以看到它的具体实现。它用来进行知识图谱搜索和向量搜索。默认的 mode OR 保证了两种搜索结果的并集,结果是包含了这两个搜索方式的结果,且进行了结果去重:从知识图谱搜索(KGTableRetriever)获得的细节;从向量索引搜索(VectorIndexRetriever)获得的语义相似性搜索的详情。

Method 6: KnowledgeGraphQueryEngine

query_engine = KnowledgeGraphQueryEngine(
    storage_context=storage_context,
    service_context=service_context,
    llm=llm,
    verbose=True,
)

该引擎允许使用自然语言查询知识图谱。它使用 LLM 将自然语言查询转换为结构化查询语言(例如 NebulaGraph 的 Cypher),然后在 KG 上执行。这抽象掉了学习特定查询语言的需要。

KnowledgeGraphQueryEngine 是一个可让我们用自然语言查询知识图谱的查询引擎。它使用 LLM 生成 Cypher 查询语句,再在知识图谱上执行这些查询。这样,我们可以在不学习 Cypher 或任何其他查询语言的情况下查询知识图谱。

Method 7: KnowledgeGraphRAGRetriever

graph_rag_retriever = KnowledgeGraphRAGRetriever(
    storage_context=storage_context,
    service_context=service_context,
    llm=llm,
    verbose=True,
)
kg_rag_query_engine = RetrieverQueryEngine.from_args(graph_rag_retriever)

这是一个实现了前面描述的核心 Graph RAG 流程的专用检索器。它在 RetrieverQueryEngine 内自动化了实体提取子图检索(深度可配置)以及为下游 LLM 任务准备上下文的步骤。

KnowledgeGraphRAGRetriever 是 LlamaIndex 中的一个 RetrieverQueryEngine,它在知识图谱上执行 Graph RAG 查询。它接收一个问题或任务作为输入,并执行以下步骤:使用关键词在知识图谱中提取或 Embedding 搜索相关实体;从知识图谱中获取

阿凯广州
本文由 阿凯 审核,最后更新于 2026年7月2日
联系编辑 →
← 返回文章列表
分享到:微博

版权与免责声明:本文仅用于信息分享与交流,不构成任何形式的法律、投资、医疗或其他专业建议,也不构成对任何结果的承诺或保证。

文中提及的商标、品牌、Logo、产品名称及相关图片/素材,其权利归各自合法权利人所有。本站内容可能基于公开资料整理,亦可能使用 AI 辅助生成或润色;我们尽力确保准确与合规,但不保证完整性、时效性与适用性,请读者自行甄别并以官方信息为准。

若本文内容或素材涉嫌侵权、隐私不当或存在错误,请相关权利人/当事人联系本站,我们将及时核实并采取删除、修正或下架等处理措施。也请勿在评论或联系信息中提交身份证号、手机号、住址等个人敏感信息。