首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >LangChain >LangChain 的 RAG(检索增强生成)能力是如何实现的?

LangChain 的 RAG(检索增强生成)能力是如何实现的?

词条归属:LangChain

1. RAG 的基本原理

RAG(Retrieval-Augmented Generation)是一种让大语言模型不局限于训练知识的架构——通过从外部知识库检索相关信息,将其作为上下文注入提示词,再让模型基于这些信息生成回答。这有效解决了模型知识过时、幻觉问题和无法访问私有数据等局限。

2. LangChain 的 RAG 完整流水线

LangChain 提供了一套完整的 RAG 实现链路,涵盖五个核心步骤:

  • 文档加载(Load):通过 DocumentLoader 从 PDF、网页、目录等多种来源加载文档,支持 PyPDFLoader、WebBaseLoader、DirectoryLoader 等数十种加载器
  • 文档切分(Split):使用 TextSplitter(推荐 RecursiveCharacterTextSplitter)将大文档递归切分为合适大小的 chunk,控制 chunk_size 和 chunk_overlap 以平衡搜索精度和上下文完整性
  • 嵌入向量化(Embed):通过 Embedding 模型将每个文本 chunk 转换为数值向量,使语义相似的内容在向量空间中距离更近。支持的 Embedding 提供商包括 OpenAI、Azure、Google Gemini、Cohere、Voyage AI 等
  • 向量存储(Store):使用 VectorStore 索引 chunk 及其嵌入向量以便高效检索。支持的向量数据库包括 Chroma、Pinecone、FAISS、Milvus、Qdrant、Weaviate 等,腾讯云也提供了向量数据库(Tencent Cloud Vector Database)作为云原生选项
  • 检索与生成(Retrieve + Generate):将用户查询转为向量,在 VectorStore 中进行相似度搜索获取相关 chunk,注入提示词后由 LLM 生成答案

3. 高级 RAG 技术

LangChain 还支持多种进阶 RAG 技术以提升回答质量:

  • Multi-Query Retrieval:用 LLM 生成多个变体查询,提高召回覆盖率
  • Ensemble Retriever:结合 BM25 关键词检索和向量语义检索的混合搜索策略
  • Contextual Compression:检索后通过 LLM 压缩和提取最相关的信息片段
  • Conversational RAG:在多轮对话中维护上下文,支持基于历史对话的追问

4. Deep Agents 中的 RAG 模式

在 Deep Agents 中,RAG 支持多种编排模式:

  • Skills-guided retrievalAgent 加载相关 skill 指导如何搜索 corpus
  • Rubric-checked grounding:审核子 Agent 评估回答是否基于检索到的材料
  • Todo-driven investigation:Agent 创建待办清单逐项调查文档
  • Retrieve, offload, and delegate:检索 chunk 写入文件系统,子 Agent 并行读取和分析
相关文章
LangChain 实现AdvancedRAG增强向量检索生成
Advanced‑RAG 是基于 Naive RAG 演化而来的高级检索增强生成方案,针对朴素RAG检索不准、上下文相关性差、召回噪声多等缺陷进行多层优化。该方案完全沿用朴素RAG的基础流水线模式、不改动核心架构,仅在各流程节点嵌入预处理、后处理增强模块,精细化优化检索环节。通过引入查询改写、重排序、上下文压缩、自我校验等多种增强策略,对召回的文档片段过滤去噪、重排优先级,精准筛选高价值上下文送入大模型,以此来提升提升知识库问答的精准度与稳定性,是目前工业级RAG落地的主流优化方案。
王瑞MVP
2026-08-24
690
【RAG】检索增强生成的评估·综述
RAG(Retrieval-Augmented Generation,检索增强生成)由于其复杂的结构性和对检索知识库的依赖,使得RAG系统的评估仍存在不少的挑战。为了更好地理解这些挑战和标准化RAG评估体系,我们提出了A RAG Unified Evaluation Process of RAG (Auepora)。我们对可能的输入和输出进行了整理,总结了现有RAG评估基准中的评估目标,如相关性(Relevance)、准确性(Correctness)和忠实度(Faithfulness)。同时分析了各种数据集和量化指标。最后基于当前基准测试的局限性,指出了RAG基准测试领域发展的潜在方向,为接下来的RAG评测标准提供参考。
Known User
2024-07-19
2.3K0
RAG技术:通过向量检索增强模型理解与生成能力
本文介绍了RAG(检索增强生成)技术的原理与应用,特别是如何通过向量检索系统增强生成模型对外部知识的理解和生成能力。针对大模型缺乏实时知识和生成内容易出错的问题,本文提出了一种结合向量检索与生成模型的方法,并提供了可运行的示例代码模块。
Swift社区
2025-01-28
7140
检索增强生成(RAG)的版权新关注
2025年5月与7月,亚马逊先后与《纽约时报》以及赫斯特、康泰纳仕等传媒集团达成合作,使得旗下AI产品可以实时展示《纽约时报》的摘要和片段等。1亚马逊与《纽约时报》的合作令业界颇感意外。因为《纽约时报》此前对于AI版权问题一直持强硬态度,2023年12月便以侵犯版权为由将OpenAI诉至美国纽约南区法院,也成为了全美第一家公开起诉大模型厂商的主流媒体。2
小腾资讯君
2025-08-14
7080
RAG 技术合集:检索增强生成的实践指南
大模型“幻觉”像幽灵:参数量越大,一本正经胡说八道的可信度越高。微调(Fine-tune)能缓解,却要 GPU 土豪 + 数据标注民工;提示工程(Prompt Engineering)轻量,却受 4 k/8 k context 天花板。RAG(Retrieval-Augmented Generation)把“闭卷考试”变成“开卷带小抄”——先检索后生成,既不改权重,也能把私域知识塞进 7 B 模型,效果常追平甚至反超 60 B。本文用一份代码仓库(文末链接)串联 BM25、Dense、ColBERT、Rerank、FLARE 五类范式,帮你画出一条“能跑、能测、能上线”的 RAG 成长曲线。
江南清风起
2025-09-28
1.1K0
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券