摘要:大家好,我是你们的AI技术小伙伴。今天咱们来聊聊RAG。你是不是经常感觉,RAG这个概念听起来挺简单,但网上一看,又有什么Naive RAG, Advanced RAG… 头都大了?

别慌!今天这篇就是你的“保姆级”教程。我将用四张清晰的结构流程图,带你一眼看穿四种RAG的核心流程和应用场景,保你从此心中有数。

首先,什么是RAG?

简单说,RAG就是让大模型(LLM)学会“翻书”和“查资料”。它不让模型硬背知识,而是在需要时,从一个外部知识库(比如你公司的文档、最新的网络文章)里检索相关信息,然后结合这些信息来生成答案。

这样做的巨大好处是:答案更准、知识更新、还能告诉你“答案从哪来”

RAG 系统的工作流程分为两个主要阶段:知识库构建(离线处理)和查询响应(实时处理)。

下面,正片开始,看看RAG家族的四位成员是如何一步步“升级打怪”的。

01 — 类型一:Naive RAG(天真朴实版)

这可以说是RAG的“Hello World”版本,流程非常直来直去。

提出动因:
模型自己容易“胡说八道”(幻觉),而且肚子里的知识一旦训练完就固定了,没法更新。所以需要给它配个“外挂大脑”——知识库。

核心流程(三步走流水线):

应用场景:

  • 简单的开放域问答:比如“珠穆朗玛峰有多高?”这种事实性问题。
  • 概念解释:比如“请给我解释一下什么是量子计算”。
  • 新手入门/项目原型:想快速验证RAG想法,用它最合适,搭建简单,成本低。

一句话总结:Naive RAG就像个老实的学生,你问什么,他就去教科书里找对应的段落,然后抄下来(其实是总结)给你。但如果问题没问对,或者教科书排版很乱,他就可能找错地方。

02 — 类型二:Advanced RAG(精雕细琢版)

大家很快发现,“萌新版”不够用啊!用户问题千奇百怪,直接检索经常找不准资料。于是,工程师们给这个流水线加上了“前处理”和“后处理”。

提出动因:
用户的问题和知识库里的说法常常对不上,导致Naive RAG检索出一堆不相关的“噪声”,生成质量自然上不去。

核心流程(检索前后,多下功夫):

  • 预检索:先把你的原始问题“加工”一下。比如查询重写,把你口语化的提问改成更正式的表述;或者查询扩展,自动帮你补充一些相关的关键词。
  • 后检索:从知识库里捞出一堆文档后,不是直接就用。要先重排序,把最相关的排在最前面;或者做个摘要/压缩,只留下最精华的部分再交给模型。

应用场景:

  • 企业知识库问答:这是它的主战场!员工问“今年请病假的流程是啥?”,它能精准找到最新的人力制度文档。
  • 客服机器人:能理解用户不规范的提问,并给出精准的解决方案。
  • 需要高准确性的各类场景。书中示例用的就是这种,因为它效果和复杂度的平衡做得最好。

一句话总结:Advanced RAG像个经验丰富的秘书,在你提问后,他会先帮你把问题润色一下,再去档案室找文件;找到后不是全抱过来,而是把最关键的那几页标红、做好摘要再递给你批阅。

03 — 类型三:Modular RAG(乐高积木版)

当组件越来越多,固定的流水线就显得僵化了。于是,模块化的思想被引入,RAG变成了一个可以自由拼装的“乐高玩具”。

提出动因:
检索器、模型等组件更新太快,传统的固定管道难以快速集成新功能,维护起来太痛苦。

核心流程(可插拔的七大模块):

它把整个流程拆成了索引、预检索、检索、后检索、记忆、生成、编排等模块。最关键的是那个“编排”模块,它像一个总指挥,可以灵活地调度其他模块。

  • 支持多种模式:可以是线性的,也可以是带条件的(如果检索不到,就换种方式再检索)、循环的(不断检索直到满意为止)。
  • 功能强大:可以加入记忆模块(记住对话历史),也可以用多个检索器(同时检索数据库和搜索引擎),然后由融合算子把结果合并。

应用场景:

  • 复杂、定制化需求:比如需要同时结合搜索引擎、内部数据库和对话历史的系统。
  • 研究和新算法验证:可以轻松替换某个模块(比如换一个更牛的重排序算法)来测试效果。
  • 需要持续学习和记忆的对话系统。

一句话总结:Modular RAG像个万能工具箱,总控大脑(编排层)可以根据任务难度,自由挑选合适的工具(各个模块),组合出不同的工作流,搞定简单到复杂的各种任务。

04 — 类型四:Agentic RAG(智能特工版)

这是目前最前沿的形态,它让RAG系统不再是被动执行命令的工具,而是拥有了自主决策能力的“智能特工”。

提出动因:
要处理复杂、多步骤的任务(比如“调研一下某个领域并写份报告”),单轮检索生成根本搞不定。需要系统自己能做规划、能决策。

核心流程(多智能体协同决策):

  • 多智能体:由一个主智能体(老板)协调多个子智能体(员工),比如规划、检索、校验等智能体。
  • 动态决策:系统会自己判断:“我现在信息够吗?需要再检索一次吗?”“这个答案靠谱吗?需要校验一下吗?”
  • 多轮迭代:完成任务的过程不是一蹴而就的,而是“规划 -> 执行(检索/生成)-> 检查 -> 再规划 …”的循环过程,直到任务完成。

应用场景:

  • 复杂研究与报告生成:你让它“分析一下电动汽车市场的未来趋势”,它会自己规划步骤:先检索市场数据,再检索技术报告,最后整合成文。
  • 深度数据分析和洞察:能自动进行多维度、多步骤的数据查询和对比分析。
  • 需要自主规划和校验的复杂任务自动化。

一句话总结:Agentic RAG不再是个工具,而是一个能独立完成项目的“智能团队”。你只需要告诉它最终目标,它会自己开会讨论(规划)、分头查资料(检索)、写稿子(生成)、内部评审(校验),最后把完美的报告交到你手上。

为了方便大家理解,我做一个简单的表格总结:

类型核心思想好比是适用场景
Naive RAG简单三步走老实学生简单问答、原型验证
Advanced RAG检索前后做优化资深秘书企业知识库、客服(最常用)
Modular RAG模块化乐高积木万能工具箱复杂定制系统
Agentic RAG智能体自主规划特工团队复杂研究、报告生成、深度分析

总结一下,大部分人可能使用是在 Advanced RAG, 且在dify上可以实现到modular RAG,modular rag可以使用agent组件实现,而达到Agentic Rag则需要使用其他代码框架实现例如langchain.

如何学习大模型 AI ?

由于新岗位的生产效率,要优于被取代岗位的生产效率,所以实际上整个社会的生产效率是提升的。

但是具体到个人,只能说是:

“最先掌握AI的人,将会比较晚掌握AI的人有竞争优势”。

这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。

我在一线科技企业深耕十二载,见证过太多因技术卡位而跃迁的案例。那些率先拥抱 AI 的同事,早已在效率与薪资上形成代际优势,我意识到有很多经验和知识值得分享给大家,也可以通过我们的能力和经验解答大家在大模型的学习中的很多困惑。我们整理出这套 AI 大模型突围资料包

  • ✅ 从零到一的 AI 学习路径图
  • ✅ 大模型调优实战手册(附医疗/金融等大厂真实案例)
  • ✅ 百度/阿里专家闭门录播课
  • ✅ 大模型当下最新行业报告
  • ✅ 真实大厂面试真题
  • ✅ 2025 最新岗位需求图谱

所有资料 ⚡️ ,朋友们如果有需要 《AI大模型入门+进阶学习资源包》下方扫码获取~
在这里插入图片描述

① 全套AI大模型应用开发视频教程

(包含提示工程、RAG、LangChain、Agent、模型微调与部署、DeepSeek等技术点)
在这里插入图片描述

② 大模型系统化学习路线

作为学习AI大模型技术的新手,方向至关重要。 正确的学习路线可以为你节省时间,少走弯路;方向不对,努力白费。这里我给大家准备了一份最科学最系统的学习成长路线图和学习规划,带你从零基础入门到精通!
在这里插入图片描述

③ 大模型学习书籍&文档

学习AI大模型离不开书籍文档,我精选了一系列大模型技术的书籍和学习文档(电子版),它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础。
在这里插入图片描述

④ AI大模型最新行业报告

2025最新行业报告,针对不同行业的现状、趋势、问题、机会等进行系统地调研和评估,以了解哪些行业更适合引入大模型的技术和应用,以及在哪些方面可以发挥大模型的优势。
在这里插入图片描述

⑤ 大模型项目实战&配套源码

学以致用,在项目实战中检验和巩固你所学到的知识,同时为你找工作就业和职业发展打下坚实的基础。
在这里插入图片描述

⑥ 大模型大厂面试真题

面试不仅是技术的较量,更需要充分的准备。在你已经掌握了大模型技术之后,就需要开始准备面试,我精心整理了一份大模型面试题库,涵盖当前面试中可能遇到的各种技术问题,让你在面试中游刃有余

图片

以上资料如何领取?

在这里插入图片描述

为什么大家都在学大模型?

最近科技巨头英特尔宣布裁员2万人,传统岗位不断缩减,但AI相关技术岗疯狂扩招,有3-5年经验,大厂薪资就能给到50K*20薪!

图片

不出1年,“有AI项目经验”将成为投递简历的门槛。

风口之下,与其像“温水煮青蛙”一样坐等被行业淘汰,不如先人一步,掌握AI大模型原理+应用技术+项目实操经验,“顺风”翻盘!
在这里插入图片描述
在这里插入图片描述

这些资料真的有用吗?

这份资料由我和鲁为民博士(北京清华大学学士和美国加州理工学院博士)共同整理,现任上海殷泊信息科技CEO,其创立的MoPaaS云平台获Forrester全球’强劲表现者’认证,服务航天科工、国家电网等1000+企业,以第一作者在IEEE Transactions发表论文50+篇,获NASA JPL火星探测系统强化学习专利等35项中美专利。本套AI大模型课程由清华大学-加州理工双料博士、吴文俊人工智能奖得主鲁为民教授领衔研发。

资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的技术人员,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。
在这里插入图片描述
在这里插入图片描述

以上全套大模型资料如何领取?

在这里插入图片描述

Logo

中国智能体开发者社区,聚焦智能体与大模型开发,提供前沿资讯、实用工具链、开源项目及行业案例。通过技术沙龙、开发者大赛等活动,促进经验交流与协作,助力开发者快速构建创新智能应用。

更多推荐